{"as_of":"2026-08-10T06:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:123060d6ff9aeb0859ba200654bc1e34ef2e4611cfc8c2c67f9f80a9d193a977","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T20:34:19.183431Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.02562/citation-record","integrity":"/paper/2507.02562/integrity","json":"/paper/2507.02562/citation-record.json","paper":"/paper/2507.02562"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:24.615865Z","title":"Vincent, T","venue":null,"work_id":"713a4d32-66cb-49eb-a4e1-260665619414","year":2018},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.626818Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:3f40b020e8aeb55fd82620f3f5a29c0fecf5959d3adce369b50960784b725b2d","observation_id":"8f6d732c-4d15-4586-80b6-c0e1f71bd2cd","resolution":{"observed_at":"2026-08-06T20:34:24.740725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:24.375589Z","title":"Deep learning for audio signal processing,","venue":null,"work_id":"f2f4aca7-4955-4c11-8938-e0550bc25821","year":2019},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.682859Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:5d3ff79e6aa00119d8ce9a937f74dfdc8930f70fad90098196afd3ba5ed9bc1e","observation_id":"0b7c1c96-aa54-4704-a02f-ac3643fe9c22","resolution":{"observed_at":"2026-08-06T20:34:24.476684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:24.097678Z","title":"An overview of machine learning and other data-based methods for spatial audio capture, processing, and reproduction,","venue":null,"work_id":"12f40980-a290-4e0e-b69e-07a0670ad80a","year":2022},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.751478Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:6bd05625a818eac154c63311e123d043f87918dedd68799e0b433f34b1bca1c4","observation_id":"fdb5f126-8357-437b-ba98-b8e00b0b8027","resolution":{"observed_at":"2026-08-06T20:34:24.250544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:23.836920Z","title":"Supervised speech separation based on deep learning: An overview,","venue":null,"work_id":"5a6eaf97-f636-4521-aeb4-a1e2ddf3c635","year":2018},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.820590Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:d0384fa1777f9aa8e92069ff4fdf2a704378a12caeffab201b0294a690890f41","observation_id":"b20059bf-e282-4a17-a428-aaed197d59ee","resolution":{"observed_at":"2026-08-06T20:34:23.965425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:23.567984Z","title":"Conv-tasnet: Surpassing ideal time–frequency magnitude masking for speech separation,","venue":null,"work_id":"92bd2685-e332-4608-9c9c-b96e4e352dbf","year":2019},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.884785Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:3828d5bb122bd912eab75fda768a058dca91b09b6bd112f5291dd0dfbc9bc259","observation_id":"fb5c6f1e-772f-40d8-b637-3c9dd4cb6602","resolution":{"observed_at":"2026-08-06T20:34:23.694612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:23.308485Z","title":"Permutation invariant training of deep models for speaker-independent multi-talker speech separation,","venue":null,"work_id":"5d687521-1825-4cec-9677-22c14144e098","year":2017},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:16.960980Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:3787ca6bc37fd30211383da95089b79e69d977241c00290f8a51b2090f8ba854","observation_id":"d569034c-dc7b-47ab-ab60-bf080cd24e49","resolution":{"observed_at":"2026-08-06T20:34:23.419272Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:23.151296Z","title":"Multitalker speech separation with utterance-level permutation invariant training of deep recurrent neural networks,","venue":null,"work_id":"2ad159e4-2c37-478d-9c13-0622370b8eb6","year":1901},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.029063Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:519055001071ceeeacdf33d942b5769cd1303b9850676c69f8954b203551ad7c","observation_id":"f666c196-2277-4d17-ab48-95e6bcf58fc5","resolution":{"observed_at":"2026-08-06T20:34:23.232124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.942176Z","title":"TF-GridNet: Making time-frequency domain models great again for monaural speaker separation,","venue":null,"work_id":"132a6976-457f-4f29-a21e-c0ca521284ae","year":2023},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.095738Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:a657862517346344f4f63bdda8c4c75bf85541fc83ff355390161f6edd80b514","observation_id":"00f29c17-9a1d-4b9d-ae51-63337b8e30c9","resolution":{"observed_at":"2026-08-06T20:34:23.038293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.842425Z","title":"TF-GridNet: Integrating full- and sub-band modeling for speech separation,","venue":null,"work_id":"37cf5c12-ed4e-4d8d-bfa2-6f4e246f7a5e","year":2023},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.204361Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:b531e4488d1dfc23a37fb255d0d6f63f60de72c2ad2104edf914e43f5b942132","observation_id":"e66a0aa0-095b-4684-a331-a830d6da0dfe","resolution":{"observed_at":"2026-08-06T20:34:22.902162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.694229Z","title":"Deep Clustering: Discriminative embeddings for segmentation and separation,","venue":null,"work_id":"396009e3-6d55-4400-8a47-c616a111fef2","year":2016},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.261466Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:8da015d10852f5d10e18328e64d4c26e9e62f06c5b242f3ca784ddf82189f37f","observation_id":"ce37baa0-211e-4ed5-8c75-62e1765b99a3","resolution":{"observed_at":"2026-08-06T20:34:22.764820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.475941Z","title":"Low-latency deep clustering for speech separation,","venue":null,"work_id":"d2b807ef-4119-4024-9930-ea9a0d317bb0","year":2019},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.371722Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:e9f238b78c7a94b31bece9b01543a6dc02a3568a6f85b6bc2c919a570854cd75","observation_id":"451cbdec-a1fb-4f5b-aad3-0abfd9d5f366","resolution":{"observed_at":"2026-08-06T20:34:22.580472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.276369Z","title":"Wavesplit: End-to-end speech separation by speaker clustering,","venue":null,"work_id":"8d167a63-3d73-4232-86b4-815ae8165587","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.457911Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:f7748bbef9fc093d62ea934621c8e2cc970839f0d9a94759e518a6c1039af4f8","observation_id":"7338dabe-3aba-446f-b1e7-4866b44fb917","resolution":{"observed_at":"2026-08-06T20:34:22.348474Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.175312Z","title":"Continuous speech separation: Dataset and analysis,","venue":null,"work_id":"fd310afc-60da-42c4-86bf-4726eac65d97","year":2020},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.485139Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:a5d3e80ef2df4c3b02a5bf3d21ffac5d98d770d946432bd4dd1bf5197e1a723f","observation_id":"7c441472-6f2c-4910-aea8-1da392cf83da","resolution":{"observed_at":"2026-08-06T20:34:22.214251Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:22.052972Z","title":"Dual-path modeling for long recording speech separation in meetings,","venue":null,"work_id":"e4a6bd02-c7be-4c47-ac01-142380508f2f","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.542031Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:1684d4da25984c575f6570ffbaa0539f0a4e08af847706f9fc03e282f64ea07f","observation_id":"54569f0a-8897-4a8a-9d63-e6b7abebb338","resolution":{"observed_at":"2026-08-06T20:34:22.107467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.953720Z","title":"Continuous speech sep- aration using speaker inventory for long recording","venue":null,"work_id":"6521206b-f5aa-43e2-8e2a-720bd57b0073","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.649108Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:5142f9eb070605e2612af306d46a2501786d5593bde705070d3c9c4c60ab7494","observation_id":"5cd83927-bba7-47f2-b959-4c76603a7d7d","resolution":{"observed_at":"2026-08-06T20:34:21.988176Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.834613Z","title":"Dual-path rnn for long recording speech separation,","venue":null,"work_id":"b31ed5fc-8acc-4358-9650-1a570948156f","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.724901Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:a7d6cacbebb2a5e064366a34924de76228fed449368168972679f2f1d5751c9c","observation_id":"a5be56f7-f207-42f0-a3c2-8d7b0287244d","resolution":{"observed_at":"2026-08-06T20:34:21.889819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.722478Z","title":"Dual-Path RNN: Efficient long sequence modeling for time-domain single-channel speech separation,","venue":null,"work_id":"3e08647d-1e64-4ae8-8583-5f96061e7d9e","year":2020},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.855381Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:4d4989de200757b7b0690acd8504f480966828753c8fea3e9bd7e00f645a66b0","observation_id":"8b038d2e-da94-447a-b36e-3dd74eea51b8","resolution":{"observed_at":"2026-08-06T20:34:21.761512Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.609855Z","title":"Segment-less continuous speech separation of meetings: Training and evaluation criteria,","venue":null,"work_id":"730905b5-fb84-40d7-8bd7-ed77e44da50d","year":2022},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.893330Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:bf401ced7531c065bb20ffe17322f9c30303486ac59e4c27a91b37ef980ed589","observation_id":"8d90e3c2-f708-49e1-b325-3c596a17a1ad","resolution":{"observed_at":"2026-08-06T20:34:21.647617Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.462529Z","title":"PLDA for speaker verification with utterances of arbitrary duration,","venue":null,"work_id":"e864b148-eede-47a0-bfc4-3ab4d7374b6b","year":2013},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:17.950494Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:ca21f18ede24fc53b099add8c73ee2d0bcbea5eb9c03117d8c6218664e9cfde7","observation_id":"623650c6-f496-442a-a3a1-616d560f5ab7","resolution":{"observed_at":"2026-08-06T20:34:21.541562Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.354422Z","title":"X- vectors: Robust dnn embeddings for speaker recognition,","venue":null,"work_id":"7ab4a00e-8f76-4f82-ad19-6041ddbbe948","year":2018},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.061528Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:4ce355daefe4414a1addedd74f602c7a9cea0a425b7369adfcdcfb0fa1b6cbfd","observation_id":"ee9ee843-3ff8-42b7-bcbf-f30997d242bd","resolution":{"observed_at":"2026-08-06T20:34:21.396438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.270905Z","title":"Speaker recognition for multi-speaker conversations using x-vectors,","venue":null,"work_id":"158be927-b4b3-4482-b259-71b56aa81708","year":2019},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.131106Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:0df24bd4d7aefc964b6fd80c9933ab2329a2e11b237726d4d744f11d68562841","observation_id":"7069435a-65d3-4d91-90fb-f740ceb75ee8","resolution":{"observed_at":"2026-08-06T20:34:21.300074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.163118Z","title":"Deep attractor network for single- microphone speaker separation,","venue":null,"work_id":"32ee0d87-b4fd-4246-b017-28741d140842","year":2017},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.200629Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:ff6e49c28836003edd097be6603618a5a9f061fe8167d2debc105a628df35d37","observation_id":"977e9f2d-c1eb-414c-bbe1-5b10c16ab724","resolution":{"observed_at":"2026-08-06T20:34:21.226423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:21.092300Z","title":"Speaker-independent speech separation with deep attractor network,","venue":null,"work_id":"e13f490d-ea13-49c5-84ed-6cfa4eca0447","year":2018},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.287890Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:a99d3066bf66364c61d93f1088d007b3eb93ff71bf5536b90b7125af1ea61501","observation_id":"ecbfc3db-7d0b-47f9-8ab8-d89d2e429f27","resolution":{"observed_at":"2026-08-06T20:34:21.124785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.949105Z","title":"Speech separation for an unknown number of speakers using transformers with encoder-decoder attractors,","venue":null,"work_id":"b880c6b4-42e6-4290-8cee-c4a5f84cf15e","year":2022},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.374939Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:79f279d5d1dedfb6b6e6c41dbf19aae8df48aea5423e50ab0c97fdfc45d58cc3","observation_id":"32be884b-6432-4ede-98f5-bdd9aed30d97","resolution":{"observed_at":"2026-08-06T20:34:21.031541Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.817978Z","title":"Boosting unknown-number speaker separation with transformer decoder-based attractor,","venue":null,"work_id":"6c54c6ac-2990-4c31-bb76-0807e9932a29","year":2024},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.436921Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:46a4597cb18773584d1002dd639b52e01131ebcb15a45a940bab63d552323651","observation_id":"cb299b78-a24a-47e7-b132-4f5ecbf2d9f5","resolution":{"observed_at":"2026-08-06T20:34:20.878145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16607","last_updated":"2025-05-22T12:41:42Z","snapshot_observed_at":"2026-08-07T14:55:48.629397Z","submitted_at":"2025-05-22T12:41:42Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","version":1},"cited_work":{"arxiv_id":"2505.16607","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16607","snapshot_observed_at":"2026-08-06T20:34:19.302217Z","title":"Attractor-Based Speech Separation of Multiple Utterances by Unknown Number of Speakers","venue":"eess.AS","work_id":"043ceae9-26e1-4627-98a6-aa893e5fda1e","year":2025},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.479293Z"},"links":{"cited_paper":"/paper/2505.16607","citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:636c5868642ed37fb14dd37a9ac9afce9ba59dd16043ea96eb9b4eccdb446474","observation_id":"d033676c-bc22-4840-8d9d-e9b7d4b82078","resolution":{"observed_at":"2026-08-06T20:34:19.369203Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.645859Z","title":"SDR – half- baked or well done?","venue":null,"work_id":"8c79a23e-cd8a-41c4-9886-7806bb24cd52","year":2019},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.582211Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:e33e09fdd1c6ed0bac8358bf0355524d69b954c466fc009b4257cd8d2c468c8d","observation_id":"49d8a6b4-7547-4a33-b898-6c44cb60ebe8","resolution":{"observed_at":"2026-08-06T20:34:20.740694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.537087Z","title":"LibriSpeech: an ASR corpus based on public domain audio books,","venue":null,"work_id":"4e0aea5e-7703-4cae-9781-16e9334fcdd8","year":2015},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.625210Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:06b5d4cc7bec2838b2ab35e977b81676a2e70fcf6ccb4b8a57de6e9bb79eb4a0","observation_id":"682b03f1-8f37-414a-a14e-a9cb909e786e","resolution":{"observed_at":"2026-08-06T20:34:20.600299Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.354598Z","title":"The diverse environments multi- channel acoustic noise database (DEMAND): A database of multichannel environmental noise recordings,","venue":null,"work_id":"9a9f639c-c005-45fa-ade9-67bc0b2ce867","year":2013},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.723198Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:73cc09665551bdb6ae4e328660881a193fe87e4ab63de224f11e3b1e5c96f466","observation_id":"f96e3fad-374d-4b8f-a131-3af94949661b","resolution":{"observed_at":"2026-08-06T20:34:20.418612Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.230316Z","title":"gpuRIR: A python library for room impulse response simulation with gpu acceleration,","venue":null,"work_id":"46afd0d9-e247-4f1f-86e3-fe8e0692b901","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.816700Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:113c28ae07330291eeaaef5f0ae28ea87367e850f130c8542dafa39d183217de","observation_id":"60373583-bd0c-4ce0-b3ed-2f2a8ef36e57","resolution":{"observed_at":"2026-08-06T20:34:20.290917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:20.073179Z","title":"ESPnet: End-to-end speech processing toolkit,","venue":null,"work_id":"35500ff4-3a99-4bf8-840a-1c3a8ac67f94","year":2018},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.897739Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:96092d0856b30fa1d04b410df6c8a1b8f213f531c6eebb5b8d942deb44145186","observation_id":"47d7f29b-46d2-4ef0-8f71-37a032ce5269","resolution":{"observed_at":"2026-08-06T20:34:20.189643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:19.917348Z","title":"Pyannote. metrics: A toolkit for reproducible evaluation, diagnostic, and error analysis of speaker diarization systems,","venue":null,"work_id":"d1beac04-6f0d-49e4-8036-e5a336fbf2ba","year":2017},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:18.944665Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:df19a20ea451a4a289178ec3c1a0b986ad24702491cbe35f1697be9838a2eab8","observation_id":"01ac8d89-0cee-4856-a343-0338dc858ee5","resolution":{"observed_at":"2026-08-06T20:34:19.966714Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:19.719692Z","title":"Dual-path transformer network: Direct context-aware modeling for end-to-end monaural speech separation,","venue":null,"work_id":"762d17e5-4bcc-4304-a813-945af48ef1e2","year":2020},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:19.013079Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:3c3544a601f2d4001f711e108e36f076d1991aff5d86f84ebeb001a60c88c384","observation_id":"1cfe8a5b-ddf7-4843-9e78-fc9df44546fc","resolution":{"observed_at":"2026-08-06T20:34:19.808007Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:19.570715Z","title":"Attention is all you need in speech separation,","venue":null,"work_id":"5fe230a1-9cd1-4922-a69e-5e674e8fb4a3","year":2021},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:19.109410Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:31cfc383d6db715ce08c2a1601cc5afc21ea3e7531bfec37489f8d876c131193","observation_id":"105304f0-c41f-4672-a145-23e1613161ef","resolution":{"observed_at":"2026-08-06T20:34:19.624654Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T20:34:19.444772Z","title":"SA-SDR: A novel loss function for separation of meeting style data,","venue":null,"work_id":"ef9c43b0-74ee-460e-8c62-daf1e08c7736","year":2022},"citing_paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T20:34:19.183431Z"},"links":{"citing_paper":"/paper/2507.02562"},"observation_digest":"sha256:d1b49888095ae0125fd8fa4ece6848ced5d5dd029070c8a0da195812e6983411","observation_id":"be78cd39-dc2e-4556-8eeb-e1159868bee2","resolution":{"observed_at":"2026-08-06T20:34:19.503073Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.02562","last_updated":"2025-07-03T12:12:34Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-06T20:23:44.042814Z","submitted_at":"2025-07-03T12:12:34Z","title":"Multi-Utterance Speech Separation and Association Trained on Short Segments"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":1,"verified_fuzzy":34},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2507.02562."}