{"as_of":"2026-08-09T14:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7e9b367b91969ac31e66d5ad87c0bf0181eca8503051deedcc43c83ef438cb0a","coverage":[{"denominator":37,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":37,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:23:29.940770Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:23:25.953421Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-07T13:23:30.843654Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"cited_work":{"arxiv_id":"2505.22013","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22013","snapshot_observed_at":"2026-08-07T13:23:30.843654Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","venue":"cs.SD","work_id":"ba59430b-2618-475f-ae8c-c178ba376d8e","year":2025},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:25.953421Z"},"links":{"cited_paper":"/paper/2505.22013","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:47a5cb36fa800f4b9d6979afc63b65787ed0796e07f09b98351a63800ae3e9e3","observation_id":"ed463cfe-7b48-425e-97aa-9502d6e0b59e","resolution":{"observed_at":"2026-08-07T13:23:30.944096Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.22013","snapshot_observed_at":"2026-08-02T21:15:34.842895Z","title":"Overlap-adaptive hybrid speaker diarization and asr-aware observation addition for misp 2025 challenge,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.20967","last_updated":"2026-06-06T10:41:57Z","snapshot_observed_at":"2026-08-09T03:23:13.450394Z","submitted_at":"2026-02-24T14:46:54Z","title":"Training-Free Intelligibility-Guided Observation Addition for Noisy ASR","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-02T21:15:34.842895Z"},"links":{"cited_paper":"/paper/2505.22013","citing_paper":"/paper/2602.20967"},"observation_digest":"sha256:59c7904fcf5c47aed8da7226999dba98d87b4ed5972a21f7a6c770fd1394a2d4","observation_id":"5db52e1a-d2cb-44db-9de1-d2340b356d52","resolution":{"observed_at":"2026-08-02T21:15:34.842895Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.22013/citation-record","integrity":"/paper/2505.22013/integrity","json":"/paper/2505.22013/citation-record.json","paper":"/paper/2505.22013"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:35.086622Z","title":"This challenge provides an open- source, state-of-the-art, large-scale multimodal meeting dataset that encompasses meetings of various sizes and rich topic transitions[2]","venue":null,"work_id":"ee5b6c9b-a058-439d-b37b-dc7d37ed6853","year":2025},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:25.846728Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:7b60d6e204596c8eb6a73974d81df2fb692284991c0374d3479e7904fef6bf5e","observation_id":"7a9abf0c-82c5-467c-a34d-9e2dc0ab8ac6","resolution":{"observed_at":"2026-08-07T13:23:35.169897Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"cited_work":{"arxiv_id":"2505.22013","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.22013","snapshot_observed_at":"2026-08-07T13:23:30.843654Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","venue":"cs.SD","work_id":"ba59430b-2618-475f-ae8c-c178ba376d8e","year":2025},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:25.953421Z"},"links":{"cited_paper":"/paper/2505.22013","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:47a5cb36fa800f4b9d6979afc63b65787ed0796e07f09b98351a63800ae3e9e3","observation_id":"ed463cfe-7b48-425e-97aa-9502d6e0b59e","resolution":{"observed_at":"2026-08-07T13:23:30.944096Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:34.933696Z","title":null,"venue":null,"work_id":"1dad53de-e032-48d3-a153-3da505a0ba83","year":null},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:26.071303Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:b38b30ac634e4f9dd8f88c11378fb65b80ecfef29a990e58d1dae0d097b76cbf","observation_id":"536a7f56-bd20-4fa6-9546-ef70a21ebdeb","resolution":{"observed_at":"2026-08-07T13:23:34.996356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:34.740714Z","title":"Experimental Setup For the end-to-end segmentation method, the clustering thresh- old was set to 0.65","venue":null,"work_id":"e17f42df-8d3d-4e61-96b9-ab34d1f53e96","year":null},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:26.171352Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:e54ae50b3357817d44471efd64b4bd74b421fbf95c75ef6dca88d63a2ccf6e75","observation_id":"3449c00d-321a-4101-8c55-35c9476f0665","resolution":{"observed_at":"2026-08-07T13:23:34.856495Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:34.562154Z","title":"For the diarization task, we combined traditional multi-module methods with a WavLM-based end- to-end segmentation model","venue":null,"work_id":"ba0ed49a-630d-4c37-a07f-1297e30b1eca","year":2025},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:26.292276Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:2f6842b33fb90c6ffbe1bf69c34778a5d365d41ca834efd6d8f568d2580fcbd4","observation_id":"91844860-1edc-4085-ac88-3e312ab9604e","resolution":{"observed_at":"2026-08-07T13:23:34.657544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:34.448962Z","title":null,"venue":null,"work_id":"c632aad3-aee5-45ad-b5d7-e181c296f6a8","year":null},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:26.440054Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:46245fc0acd71c0044e751fafa57900b42a76d222a7d95184b6acffb6b2b13fb","observation_id":"68c7e0e7-a9bf-4d9f-9ab5-b4be08a457fc","resolution":{"observed_at":"2026-08-07T13:23:34.500101Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13971","last_updated":"2025-05-27T05:03:46Z","snapshot_observed_at":"2026-08-08T08:23:35.619235Z","submitted_at":"2025-05-20T06:11:51Z","title":"The Multimodal Information Based Speech Processing (MISP) 2025 Challenge: Audio-Visual Diarization and Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13971","snapshot_observed_at":"2026-08-07T13:23:26.572189Z","title":"The multimodal information based speech processing (misp) 2025 challenge: Audio-visual diarization and recognition,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:26.572189Z"},"links":{"cited_paper":"/paper/2505.13971","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:787f1767e691bfa72e1d9af51d5d663d54dd30b2c6c5c0da3ca693d2e1494c73","observation_id":"02c18a0e-adb3-4d68-9574-028150db69db","resolution":{"observed_at":"2026-08-07T13:23:26.572189Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:34.234908Z","title":"MISP-Meeting: A real-world dataset with multimodal cues for long-form meeting transcription and summarization,","venue":null,"work_id":"70bd7db5-a6f4-40b6-8b3a-1c9fccbda7d3","year":2025},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:26.693271Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:a94c113a8b2bcfcaf3f17d71a558ed16dc761421cc4acc3fe3bb8e57643420f7","observation_id":"5302877b-d639-4182-8b72-4c7adef1aa51","resolution":{"observed_at":"2026-08-07T13:23:34.334745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:34.054155Z","title":"Multi-stage diarization refinement for the chime-7 dasr scenario,","venue":null,"work_id":"52e8f33a-5b9f-47ce-b813-10f2c71599be","year":2023},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:26.870998Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:cac699870340ccc30c43492278692cea427606b45eb4948a5180a0fa2c5fb3fb","observation_id":"f69939fe-744b-43ae-9fef-4898a580d4fa","resolution":{"observed_at":"2026-08-07T13:23:34.159449Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05554","last_updated":"2024-09-09T12:21:42Z","snapshot_observed_at":"2026-08-04T15:18:47.921344Z","submitted_at":"2024-09-09T12:21:42Z","title":"NTT Multi-Speaker ASR System for the DASR Task of CHiME-8 Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05554","snapshot_observed_at":"2026-08-07T13:23:26.979307Z","title":"Ntt multi-speaker asr system for the dasr task of chime-8 challenge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:26.979307Z"},"links":{"cited_paper":"/paper/2409.05554","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:2151a6995afb81b04660a99f18b68d1a1c1608654be269429c0a4d53d6a0a52d","observation_id":"973149e0-abda-4ee3-8290-c81eb8d70a74","resolution":{"observed_at":"2026-08-07T13:23:26.979307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:33.796824Z","title":"The whu- alibaba audio-visual speaker diarization system for the misp 2022 challenge,","venue":null,"work_id":"9256336d-0706-4b6e-9100-fa6828e195c1","year":2022},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:27.114556Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:4aa3320fc1ffbda3f2ef70fac6f846425de9627bf1d473369a4ac648350c737d","observation_id":"590e165e-9a8f-4b89-9f89-04fc5fc412ee","resolution":{"observed_at":"2026-08-07T13:23:33.932336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:33.649895Z","title":"Multi-speaker end-to-end multi-modal speaker diarization system for the misp 2022 chal- lenge,","venue":null,"work_id":"b2c103f5-42d5-456a-af6b-ccc04c78ac18","year":2022},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:27.255898Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:08fe65ec3bec665f57b8efa559d0bfe318790b7a7a59224ab1130fa3f96bb08c","observation_id":"91b8a53f-4193-4fd7-8885-07251c7e07e2","resolution":{"observed_at":"2026-08-07T13:23:33.703589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:33.400790Z","title":"The mul- timodal information based speech processing (misp) 2022 chal- lenge: Audio-visual diarization and recognition,","venue":null,"work_id":"77bce4ae-9bb7-49ed-bf2d-9250c8d6a98f","year":2022},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:27.368410Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:efa68a9153d4af79c103d6817f1bf0630aa3d04412be19838a917285fd7a80e4","observation_id":"d9e5a788-53a8-4ce5-bfa2-58f5f5d46f39","resolution":{"observed_at":"2026-08-07T13:23:33.538173Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15400","last_updated":"2023-07-28T08:50:29Z","snapshot_observed_at":"2026-08-03T23:13:24.429788Z","submitted_at":"2023-07-28T08:50:29Z","title":"The FlySpeech Audio-Visual Speaker Diarization System for MISP Challenge 2022","version":1},"cited_work":{"arxiv_id":"2307.15400","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.15400","snapshot_observed_at":"2026-08-07T13:23:30.591872Z","title":"The FlySpeech Audio-Visual Speaker Diarization System for MISP Challenge 2022","venue":"cs.SD","work_id":"a3e4a454-8f36-4437-8d06-0235dfe0b387","year":2023},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:27.452453Z"},"links":{"cited_paper":"/paper/2307.15400","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:61e022c61434aebe9c5869502f86fa944927e19461dac122739605ff8888a386","observation_id":"07d1ec16-ce9a-4332-a5a3-4193fea2c03d","resolution":{"observed_at":"2026-08-07T13:23:30.685369Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:33.099101Z","title":"Ntt speaker diarization system for chime-7: multi-domain, multi-microphone end-to-end and vector clustering diarization,","venue":null,"work_id":"4b795c88-b733-4930-9b5d-30f17d808ec4","year":2024},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:27.590626Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:ba609a1d709ba6f1a9ea9803c5e5e9fad98ba79618960af0915c5d79b7ec1368","observation_id":"6870c7e2-d81d-4ab7-9e90-6856fce43414","resolution":{"observed_at":"2026-08-07T13:23:33.269339Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:32.797334Z","title":"The fosafer system for the icassp2024 in-car multi-channel automatic speech recognition challenge,","venue":null,"work_id":"939a7a50-0fed-40b1-aa4f-7ea038d423e1","year":2024},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:27.692607Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:00ddfcbe077ae40a63529cec78b4ab05b7f14d2148b662d4b9b04dc8f46eba21","observation_id":"74e44bcb-a6ea-4746-a7c6-851509f43313","resolution":{"observed_at":"2026-08-07T13:23:32.960814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.09408","last_updated":"2024-10-21T07:46:22Z","snapshot_observed_at":"2026-08-07T06:22:41.508428Z","submitted_at":"2024-09-14T10:49:06Z","title":"Leveraging Self-Supervised Learning for Speaker Diarization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.09408","snapshot_observed_at":"2026-08-07T13:23:27.854046Z","title":"Leveraging self-supervised learning for speaker diarization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:27.854046Z"},"links":{"cited_paper":"/paper/2409.09408","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:9e29aa6171923583a46ec49e3ba21cccf6a1b160cbaa44bbe1ac8f8fe6e9241b","observation_id":"1dde31ec-7d47-4e3d-a560-aa9f538fbda4","resolution":{"observed_at":"2026-08-07T13:23:27.854046Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:32.574791Z","title":"Powerset multi-class cross entropy loss for neural speaker diarization,","venue":null,"work_id":"7091dfcf-d754-4c47-99d1-00c4d819dc5c","year":2023},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:27.955584Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:fcbf2e19b822756a4788e6ae23073f6bc89ed2ffa98ae10708981017615d97bf","observation_id":"05a7e0b0-a2cb-4a29-8d90-a07eaf33c2da","resolution":{"observed_at":"2026-08-07T13:23:32.689249Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:32.418201Z","title":"MP-SENet: A speech enhance- ment model with parallel denoising of magnitude and phase spec- tra,","venue":null,"work_id":"968e9aed-a946-4a4c-8104-1bf1d0d966f1","year":2023},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:28.055567Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:9940dc369456435d571a09477e9bb7562499d6157cb3859a0f59874159d7ad34","observation_id":"d8fbaa23-7e6e-45c9-ac3d-bfb692c01819","resolution":{"observed_at":"2026-08-07T13:23:32.477931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:32.279083Z","title":"Simam: A sim- ple, parameter-free attention module for convolutional neural networks,","venue":null,"work_id":"39816f57-86d8-4846-a263-1f766629e25b","year":2021},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:28.188007Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:9bceb5892f09274315847ba5231c4e38266de8771491a7f68170c00244ebc20e","observation_id":"7d32b33f-236f-40ad-83e0-1cecf05e7bad","resolution":{"observed_at":"2026-08-07T13:23:32.349174Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:32.153767Z","title":"Wespeaker: A research and production oriented speaker embedding learning toolkit,","venue":null,"work_id":"f0b754b3-7be9-4663-ad46-779f1c68f9e6","year":2023},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:28.318190Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:88b2aca9f49a7debd200acb19ad1b7c4175f9faaf26293b8cfdc7d99446eb545","observation_id":"6c1c6b3a-64d5-4204-ac26-2d64774e8d3e","resolution":{"observed_at":"2026-08-07T13:23:32.200685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:32.052708Z","title":"Bayesian hmm clustering of x-vector sequences (vbx) in speaker diarization: the- ory, implementation and analysis on standard tasks,","venue":null,"work_id":"2ceba1ee-35f4-445b-a6a9-2944d6767b2d","year":2022},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:28.418776Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:0fa1695c75b6e9c7b40b894ee7f516f659e15e51fc5b6bfdc68c265deac9a30b","observation_id":"cccaec59-4f4d-4f1f-8e6f-ffb416ead240","resolution":{"observed_at":"2026-08-07T13:23:32.099563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:31.907618Z","title":"Dover-lap: A method for com- bining overlap-aware diarization outputs,","venue":null,"work_id":"7a2ffee6-57ce-4446-aaba-c6ea73239cca","year":2021},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:28.521282Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:118225e2dac0adb6934a1dbaf5a331bec18da2a60ae69015414f49935b3196f2","observation_id":"67e04f08-3f3b-4044-9d6f-485600b08c63","resolution":{"observed_at":"2026-08-07T13:23:31.973817Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05271","last_updated":"2023-08-13T18:30:43Z","snapshot_observed_at":"2026-08-02T11:59:18.040781Z","submitted_at":"2022-12-10T11:20:17Z","title":"GPU-accelerated Guided Source Separation for Meeting Transcription","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05271","snapshot_observed_at":"2026-08-07T13:23:28.662837Z","title":"Gpu-accelerated guided source separation for meeting transcription,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:28.662837Z"},"links":{"cited_paper":"/paper/2212.05271","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:bfcadfa192ca9cc826ed858108a23e0fe98cf4c306d15ec8cdba2050eb145c59","observation_id":"d7a9dbc3-1aad-490b-b631-19fc0f284b2d","resolution":{"observed_at":"2026-08-07T13:23:28.662837Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.03697","last_updated":"2024-03-07T02:59:17Z","snapshot_observed_at":"2026-08-01T14:36:59.572512Z","submitted_at":"2024-01-08T07:04:30Z","title":"An audio-quality-based multi-strategy approach for target speaker extraction in the MISP 2023 Challenge","version":2},"cited_work":{"arxiv_id":"2401.03697","doi":null,"metadata_source":"pith","pith_arxiv_id":"2401.03697","snapshot_observed_at":"2026-08-07T13:23:30.330097Z","title":"An audio-quality-based multi-strategy approach for target speaker extraction in the MISP 2023 Challenge","venue":"cs.SD","work_id":"729df5f9-3102-4fc6-8a18-661f65362338","year":2024},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:28.744748Z"},"links":{"cited_paper":"/paper/2401.03697","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:91fd97e2eb7a6b8b24e7438c525dddaea30a6265fc6c53416502aff765503d56","observation_id":"3ecfc636-661f-419d-b177-d1ec1a584ee1","resolution":{"observed_at":"2026-08-07T13:23:30.445518Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:28.834254Z","title":"The fos- afer system for the chime-8 mmcsg challenge,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:28.834254Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:b7ccca92ec2803a1ba8812421d003581f4e43275b4c3d3bc8afa3f4082636473","observation_id":"ba615680-2ab2-4cdb-80ce-c3af288fa474","resolution":{"observed_at":"2026-08-07T13:23:28.834254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:28.950134Z","title":"Enhanced asr for stuttering speech: Combining adversarial and signal-based data augmentation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:28.950134Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:a8bbff942984bb1e07fcdd15f131cf30508d38ed6d4f0361df5f72456448b639","observation_id":"842d1754-2ec9-41a0-93ff-eaaa670087a5","resolution":{"observed_at":"2026-08-07T13:23:28.950134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.02452","last_updated":"2025-01-05T06:12:07Z","snapshot_observed_at":"2026-08-09T12:40:47.535144Z","submitted_at":"2025-01-05T06:12:07Z","title":"Reducing the Gap Between Pretrained Speech Enhancement and Recognition Models Using a Real Speech-Trained Bridging Module","version":1},"cited_work":{"arxiv_id":"2501.02452","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.02452","snapshot_observed_at":"2026-08-07T13:23:30.132470Z","title":"Reducing the Gap Between Pretrained Speech Enhancement and Recognition Models Using a Real Speech-Trained Bridging Module","venue":"cs.SD","work_id":"c3c58735-96f3-4f8a-9276-27ae72c5ee58","year":2025},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:29.118518Z"},"links":{"cited_paper":"/paper/2501.02452","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:8b0faff91c10edaaeb2684e007783295dd80c9e2c75054ec5e1f46672406834c","observation_id":"1e718df9-ba6d-4527-8119-c4b9e747e681","resolution":{"observed_at":"2026-08-07T13:23:30.228113Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:31.596409Z","title":"Mossformer2: Com- bining transformer and rnn-free recurrent network for enhanced time-domain monaural speech separation,","venue":null,"work_id":"8a566e6f-d6c7-4fee-bcc2-c604dc87a2be","year":2024},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:29.202514Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:9e55781addfb2bfcc2afee45a74646f7f3a05e789418735a31f663e6cb34ebf4","observation_id":"336a417b-ea1e-48ad-b4f7-bbd5bd58078b","resolution":{"observed_at":"2026-08-07T13:23:31.760323Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01164","last_updated":"2023-09-03T13:00:04Z","snapshot_observed_at":"2026-08-03T15:30:39.358724Z","submitted_at":"2023-09-03T13:00:04Z","title":"Noise robust speech emotion recognition with signal-to-noise ratio adapting speech enhancement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.01164","snapshot_observed_at":"2026-08-07T13:23:29.266135Z","title":"Noise robust speech emotion recognition with signal-to-noise ratio adapting speech en- hancement,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:29.266135Z"},"links":{"cited_paper":"/paper/2309.01164","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:7511811a0e48bab20d5e8fad0c7b9907ab6f180159c06f0440f670b84b0bccdd","observation_id":"34e5e73c-0760-42c1-9137-53e2a9b20fc7","resolution":{"observed_at":"2026-08-07T13:23:29.266135Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.10963","last_updated":"2019-02-25T01:44:06Z","snapshot_observed_at":"2026-08-02T00:52:09.236237Z","submitted_at":"2018-03-29T08:45:55Z","title":"Attentive Statistics Pooling for Deep Speaker Embedding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.10963","snapshot_observed_at":"2026-08-07T13:23:29.338784Z","title":"Attentive statis- tics pooling for deep speaker embedding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:29.338784Z"},"links":{"cited_paper":"/paper/1803.10963","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:dde50f37b4deeb1543ddf17ee68a460fbb15142fa4335be4f7db721a0c7eed89","observation_id":"24628086-a7cd-4cb3-a4d3-3f358013bae8","resolution":{"observed_at":"2026-08-07T13:23:29.338784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:31.295999Z","title":"Integrating self-supervised pre-training with adversarial learning for synthe- sized song detection,","venue":null,"work_id":"0f6ce32e-38ae-4c2c-a1f6-7342640da23f","year":2024},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:29.429736Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:591a6cc7e9375dfd96d0ed1dad3a45cb00fd952dfca43c3766ad5ad7c008dee1","observation_id":"10ea403f-15be-43b6-9818-c1ba7f43475f","resolution":{"observed_at":"2026-08-07T13:23:31.451027Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:29.547277Z","title":"Pyroomacoustics: A python package for audio room simulation and array processing algorithms,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:29.547277Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:997efa1dbbda0ecdf69acedf99f423ae104adf487f26fb727267ea816b4a4f8f","observation_id":"5e9b4a6c-006d-4db9-9223-3dc2e28b1b74","resolution":{"observed_at":"2026-08-07T13:23:29.547277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05622","last_updated":"2018-06-27T01:49:17Z","snapshot_observed_at":"2026-08-08T04:36:13.309903Z","submitted_at":"2018-06-14T15:59:12Z","title":"VoxCeleb2: Deep Speaker Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.05622","snapshot_observed_at":"2026-08-07T13:23:29.667033Z","title":"V oxceleb2: Deep speaker recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:29.667033Z"},"links":{"cited_paper":"/paper/1806.05622","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:e7e6f9a9c70e8555e43f3507e8db80c2eccff546fc222da854d7c872a55f40ae","observation_id":"013dbd25-e97e-496d-9470-0bf77c1f6be4","resolution":{"observed_at":"2026-08-07T13:23:29.667033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2206.08317","last_updated":"2023-03-30T07:00:38Z","snapshot_observed_at":"2026-08-01T16:05:21.888603Z","submitted_at":"2022-06-16T17:24:14Z","title":"Paraformer: Fast and Accurate Parallel Transformer for Non-autoregressive End-to-End Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.08317","snapshot_observed_at":"2026-08-07T13:23:29.774239Z","title":"Paraformer: Fast and accurate parallel transformer for non-autoregressive end-to- end speech recognition,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:29.774239Z"},"links":{"cited_paper":"/paper/2206.08317","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:680378ff6820af73c540874bf6601798d4431fe02861f2caa581b6fac97a373c","observation_id":"5fa2184b-201e-41e5-a057-78f648ed1c48","resolution":{"observed_at":"2026-08-07T13:23:29.774239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04051","last_updated":"2024-07-11T02:08:35Z","snapshot_observed_at":"2026-08-06T00:42:36.144034Z","submitted_at":"2024-07-04T16:49:02Z","title":"FunAudioLLM: Voice Understanding and Generation Foundation Models for Natural Interaction Between Humans and LLMs","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04051","snapshot_observed_at":"2026-08-07T13:23:29.874646Z","title":"Funaudiollm: V oice understanding and gen- eration foundation models for natural interaction between humans and llms,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:29.874646Z"},"links":{"cited_paper":"/paper/2407.04051","citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:39f878b222213901cc5127e209907c2032f501640635973c471719313f9b2e92","observation_id":"1ac13fed-1299-46fa-a53d-02f32b1fa3bd","resolution":{"observed_at":"2026-08-07T13:23:29.874646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:23:31.065164Z","title":"A post-processing system to yield reduced word er- ror rates: Recognizer output voting error reduction (rover),","venue":null,"work_id":"c9e87665-2520-409c-beaf-436e04501cfb","year":1997},"citing_paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T13:23:29.940770Z"},"links":{"citing_paper":"/paper/2505.22013"},"observation_digest":"sha256:8db08a1afc3d3299745a0967e51899c4b710a682b1afb1b455add8ab9fec8099","observation_id":"2f41979e-9761-4cce-89d9-3656e1fd9794","resolution":{"observed_at":"2026-08-07T13:23:31.187702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.22013","last_updated":"2025-05-28T06:22:37Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T10:18:11.060579Z","submitted_at":"2025-05-28T06:22:37Z","title":"Overlap-Adaptive Hybrid Speaker Diarization and ASR-Aware Observation Addition for MISP 2025 Challenge"},"reference_resolution":{"displayed":37,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":14,"verified_exact":4,"verified_fuzzy":18},"total_outbound_references":37},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 37 of 37 outbound references and 2 inbound Pith citation observations for arXiv:2505.22013."}