{"as_of":"2026-08-08T09:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8587b9e64326768f405aa09b363392b8b1b43163dd90b8d1792c125878d94733","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":4,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":4,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:55:23.255131Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-11T00:30:54.824838Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2104.04045","last_updated":"2021-06-10T13:51:47Z","snapshot_observed_at":"2026-08-04T08:32:24.769368Z","submitted_at":"2021-04-08T20:38:17Z","title":"End-to-end speaker segmentation for overlap-aware resegmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.04045","snapshot_observed_at":"2026-08-07T12:55:23.255131Z","title":"End-to-end speaker segmentation for overlap-aware resegmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.23207","last_updated":"2025-05-29T07:47:48Z","snapshot_observed_at":"2026-08-07T12:48:38.542517Z","submitted_at":"2025-05-29T07:47:48Z","title":"Towards Robust Overlapping Speech Detection: A Speaker-Aware Progressive Approach Using WavLM","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:55:23.255131Z"},"links":{"cited_paper":"/paper/2104.04045","citing_paper":"/paper/2505.23207"},"observation_digest":"sha256:527f815d8b81434ad58224843d88c48f3be352007ff1ed9378950a8a6f2c805c","observation_id":"57d4a822-6ce5-4784-8828-42d818cbb285","resolution":{"observed_at":"2026-08-07T12:55:23.255131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04045","last_updated":"2021-06-10T13:51:47Z","snapshot_observed_at":"2026-08-04T08:32:24.769368Z","submitted_at":"2021-04-08T20:38:17Z","title":"End-to-end speaker segmentation for overlap-aware resegmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.04045","snapshot_observed_at":"2026-08-07T11:51:11.727872Z","title":"End-to-end speaker segmen- tation for overlap-aware resegmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.01365","last_updated":"2025-06-02T06:47:42Z","snapshot_observed_at":"2026-08-07T11:41:26.339964Z","submitted_at":"2025-06-02T06:47:42Z","title":"Attention Is Not Always the Answer: Optimizing Voice Activity Detection with Simple Feature Fusion","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:51:11.727872Z"},"links":{"cited_paper":"/paper/2104.04045","citing_paper":"/paper/2506.01365"},"observation_digest":"sha256:b921029dc652d71d05f87ddf845981e1f14297ee573286393ff6918a6f1bccb7","observation_id":"98c46501-02bf-4a18-b6c4-d86355140ca6","resolution":{"observed_at":"2026-08-07T11:51:11.727872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04045","last_updated":"2021-06-10T13:51:47Z","snapshot_observed_at":"2026-08-04T08:32:24.769368Z","submitted_at":"2021-04-08T20:38:17Z","title":"End-to-end speaker segmentation for overlap-aware resegmentation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.04045","snapshot_observed_at":"2026-08-07T11:23:48.814942Z","title":"End-to-end speaker segmen- tation for overlap-aware resegmentation,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.02610","last_updated":"2025-06-03T08:29:10Z","snapshot_observed_at":"2026-08-07T11:18:04.250553Z","submitted_at":"2025-06-03T08:29:10Z","title":"Speaker Diarization with Overlapping Community Detection Using Graph Attention Networks and Label Propagation Algorithm","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T11:23:48.814942Z"},"links":{"cited_paper":"/paper/2104.04045","citing_paper":"/paper/2506.02610"},"observation_digest":"sha256:151df368b01c9c80fa2b8dfe29585c4b6e3e1dcf585e35f593c325cecf5c8d96","observation_id":"61fb561f-2e17-458e-9297-c88fe8f85408","resolution":{"observed_at":"2026-08-07T11:23:48.814942Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.04045","last_updated":"2021-06-10T13:51:47Z","snapshot_observed_at":"2026-08-04T08:32:24.769368Z","submitted_at":"2021-04-08T20:38:17Z","title":"End-to-end speaker segmentation for overlap-aware resegmentation","version":2},"cited_work":{"arxiv_id":"2104.04045","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2104.04045","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"End-to-end speaker seg- mentation for overlap-aware resegmentation","venue":null,"work_id":"5db6df47-c61f-4207-a04e-465defc8ff4e","year":2021},"citing_paper":{"arxiv_id":"2604.08125","last_updated":"2026-04-10T10:48:12Z","snapshot_observed_at":"2026-07-31T09:02:47.778850Z","submitted_at":"2026-04-09T11:46:14Z","title":"PolySLGen: Online Multimodal Speaking-Listening Reaction Generation in Polyadic Interaction","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T18:28:26.910105Z"},"links":{"cited_paper":"/paper/2104.04045","citing_paper":"/paper/2604.08125"},"observation_digest":"sha256:5f51922dabb300c1134462b3c2880785947b78943d1793c92e585314f026fc41","observation_id":"46d14893-fedf-4d63-a5a2-737bfa2987fe","resolution":{"observed_at":"2026-05-11T00:30:54.826960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2104.04045/citation-record","integrity":"/paper/2104.04045/integrity","json":"/paper/2104.04045/citation-record.json","paper":"/paper/2104.04045"},"outbound":[],"paper":{"arxiv_id":"2104.04045","last_updated":"2021-06-10T13:51:47Z","latest_version":2,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-04T08:32:24.769368Z","submitted_at":"2021-04-08T20:38:17Z","title":"End-to-end speaker segmentation for overlap-aware resegmentation"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 4 inbound Pith citation observations for arXiv:2104.04045."}