{"as_of":"2026-08-20T09:45:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:13f13c97903c800969498fdde0fcb72233c7de69aea429ff727e0c8b5280a470","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:06:43.547983Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:06:43.459006Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-15T20:06:43.755730Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"cited_work":{"arxiv_id":"2506.13396","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13396","snapshot_observed_at":"2026-08-15T20:06:43.755730Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","venue":"cs.CL","work_id":"83607809-fe0b-4d6a-b200-4746ea56eb0f","year":2025},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.459006Z"},"links":{"cited_paper":"/paper/2506.13396","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:d600a9869a20ef08691b7e7a62b8bb888a955aea77ec15d9dd211de52ed3d1fa","observation_id":"ae6a5da4-fba9-4eb8-b50d-69a1bc6fca0a","resolution":{"observed_at":"2026-08-15T20:06:43.760682Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.13396/citation-record","integrity":"/paper/2506.13396/integrity","json":"/paper/2506.13396/citation-record.json","paper":"/paper/2506.13396"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.903115Z","title":null,"venue":null,"work_id":"89e7d171-f12b-4207-898b-eddf4d7fa63f","year":null},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.454508Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:2c015f79d501d84fd5e4397eb041cefb404489a50d18e7133ff2947c3fedff82","observation_id":"c088a8b9-89c6-4e2c-bd0b-d8cb0b977713","resolution":{"observed_at":"2026-08-15T20:06:43.906669Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"cited_work":{"arxiv_id":"2506.13396","doi":null,"metadata_source":"pith","pith_arxiv_id":"2506.13396","snapshot_observed_at":"2026-08-15T20:06:43.755730Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","venue":"cs.CL","work_id":"83607809-fe0b-4d6a-b200-4746ea56eb0f","year":2025},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.459006Z"},"links":{"cited_paper":"/paper/2506.13396","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:d600a9869a20ef08691b7e7a62b8bb888a955aea77ec15d9dd211de52ed3d1fa","observation_id":"ae6a5da4-fba9-4eb8-b50d-69a1bc6fca0a","resolution":{"observed_at":"2026-08-15T20:06:43.760682Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.891281Z","title":null,"venue":null,"work_id":"357b47e4-4fb1-40ac-a4f1-060b8e5e4748","year":2000},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.463830Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:277cedb7ed10b30f9180d8012cf73547092c4c1ecedfd751e96d7ce1f5aafe7e","observation_id":"a0abb7e5-0f5e-45f7-9eca-17328d89b6fa","resolution":{"observed_at":"2026-08-15T20:06:43.895189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8413.5613","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.735568Z","title":null,"venue":null,"work_id":"91247092-6641-4e26-b9c0-b7f73fba6492","year":null},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.467935Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:fdd4a8cd0509f17766db5c3edd3688dd0a7f7f82141f6bea392792248e743ef3","observation_id":"705fd454-a4c1-4f62-9866-27580aeee779","resolution":{"observed_at":"2026-08-15T20:06:43.743062Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.881085Z","title":null,"venue":null,"work_id":"bc4de2de-cb08-4327-b45c-26ee0a2b6fad","year":null},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.471915Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:6c3aad8a3cdfc82f2ee26301abd1e4a381c24d9002584d89b2cc94002f6e04b0","observation_id":"901109c0-7205-42d5-ab1d-f01c36400294","resolution":{"observed_at":"2026-08-15T20:06:43.884380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.869714Z","title":"Conversational speech recognition by learning conversation-level characteristics,","venue":null,"work_id":"f79e3698-906d-48f0-a8b8-40d30d01fb15","year":2022},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.475500Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:334b17247f87ae0d08e9dd369d16da30c65c3e3b04824546d0adad00883199ac","observation_id":"85b41eca-546b-4d46-97bd-5aa94496c1f0","resolution":{"observed_at":"2026-08-15T20:06:43.874077Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.858739Z","title":"Conversational speech recognition by learning audio-textual cross-modal contex- tual representation,","venue":null,"work_id":"32380de3-fb33-4f89-9b31-cb471cb5902b","year":2024},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.479212Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:a6a36b1c54cbf83db605a1762303d7206aaaaf76770187745f4e829aff6678d8","observation_id":"e50074ac-b59d-4b1e-baf0-80c6b919fa79","resolution":{"observed_at":"2026-08-15T20:06:43.862647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.848505Z","title":"The fisher corpus: a resource for the next generations of speech-to-text,","venue":null,"work_id":"7cd6884c-c79c-4989-ac03-7588fac79dc2","year":2004},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.482632Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:1430790143ee8b650c6602eb0b9daf9278d34e359f8dbd07575d27549d802377","observation_id":"11adff10-d2e6-4820-abb0-5f8d8ea61a5a","resolution":{"observed_at":"2026-08-15T20:06:43.852179Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.837323Z","title":"Switchboard: tele- phone speech corpus for research and development,","venue":null,"work_id":"2858852b-c9df-4505-88e4-a43984ec7bb1","year":1992},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.486256Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:86ca3a5a05ff5f6c2e966f853ba7815910ff703dfba5e7ff86f66cb00389ee95","observation_id":"be0b6bbc-dec9-4a1f-ad8d-54d359a893b6","resolution":{"observed_at":"2026-08-15T20:06:43.841183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.02267","last_updated":"2022-01-25T15:27:00Z","snapshot_observed_at":"2026-08-16T17:51:40.932441Z","submitted_at":"2021-10-05T18:15:15Z","title":"BERT Attends the Conversation: Improving Low-Resource Conversational ASR","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.02267","snapshot_observed_at":"2026-08-15T20:06:43.489951Z","title":"Bert attends the conversation: Improving low-resource conversational asr,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.489951Z"},"links":{"cited_paper":"/paper/2110.02267","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:2124f053521427305086d88f9c8cf1c498cf741218cebafaea51397127f22a1c","observation_id":"14f67e18-d0c1-4131-9ce9-0312260ba327","resolution":{"observed_at":"2026-08-15T20:06:43.489951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.493589Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.493589Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:d63cf304c77db60af8dc88d6bdf4683740fce4a3901b6164d5cca77953842440","observation_id":"028b98a2-74f5-4858-9af1-52e95cb6c2fa","resolution":{"observed_at":"2026-08-15T20:06:43.493589Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.497134Z","title":"Language models are unsupervised multitask learners,","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.497134Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:117d7de87ab326ebbbbf8a9f57a192fe6ab13e00eef4b155c99fdaadb6ae77cc","observation_id":"3902a256-1528-405e-868b-11bf858d25e0","resolution":{"observed_at":"2026-08-15T20:06:43.497134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-15T20:06:43.500543Z","title":"Llama: Open and efficient foundation language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.500543Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:ee95624ed79575346b74341b939127018c1848ce95430ad84a89880d81bd1bb8","observation_id":"7d1f977d-cbaa-439d-844b-346cfc891717","resolution":{"observed_at":"2026-08-15T20:06:43.500543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-08-09T21:25:20.369782Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-15T20:06:43.504148Z","title":"Qwen technical report,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.504148Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:63ddd2d77b56d6d96e54de8953c2019933684246d18ecb45a85f86f85aeb54ce","observation_id":"684f1264-dbd1-42b5-adfd-eb4e1e56d2af","resolution":{"observed_at":"2026-08-15T20:06:43.504148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.812134Z","title":"WavLLM: Towards robust and adaptive speech large language model,","venue":null,"work_id":"c7ff89d7-7bb4-4382-a127-a722024aacc7","year":2024},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.507963Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:a76e9782cb30989354334ea3f73dc17c1f38a9cf6e4777f0b7e693e63cf9def6","observation_id":"2bda8e89-c12b-4bcc-9f64-d8397a1df748","resolution":{"observed_at":"2026-08-15T20:06:43.816048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07919","last_updated":"2023-12-21T10:20:42Z","snapshot_observed_at":"2026-08-07T10:17:55.688598Z","submitted_at":"2023-11-14T05:34:50Z","title":"Qwen-Audio: Advancing Universal Audio Understanding via Unified Large-Scale Audio-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07919","snapshot_observed_at":"2026-08-15T20:06:43.511810Z","title":"Qwen-audio: Advancing universal audio understanding via unified large-scale audio-language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.511810Z"},"links":{"cited_paper":"/paper/2311.07919","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:531c571db33ed264e38d7c657f9b38f7d58ba3b75d37a0a4d724c30012818eaa","observation_id":"c2d7a58f-334a-4f01-9a4c-2320174372d1","resolution":{"observed_at":"2026-08-15T20:06:43.511810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09818","last_updated":"2025-01-16T03:29:23Z","snapshot_observed_at":"2026-08-15T13:23:21.388081Z","submitted_at":"2024-12-13T03:15:05Z","title":"MERaLiON-AudioLLM: Bridging Audio and Language with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09818","snapshot_observed_at":"2026-08-15T20:06:43.515779Z","title":"Meralion-audiollm: Bridging audio and language with large language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.515779Z"},"links":{"cited_paper":"/paper/2412.09818","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:075fe7dc4b738d0433ef7228d6296ea90c51d2ab9e63d117f103da941dd5936e","observation_id":"f8ff8a9f-4988-494c-87d3-f77d6f0e89ca","resolution":{"observed_at":"2026-08-15T20:06:43.515779Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-08-14T01:27:16.843576Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-15T20:06:43.519359Z","title":"Qwen2-audio technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.519359Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:5c0c37555d47f292c13e4a96830ee3f26126685519d33d71ba270471e23b9321","observation_id":"6639839c-162c-49ff-893c-a229f69689ff","resolution":{"observed_at":"2026-08-15T20:06:43.519359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.11946","last_updated":"2025-02-18T07:29:10Z","snapshot_observed_at":"2026-08-12T20:35:16.024701Z","submitted_at":"2025-02-17T15:58:56Z","title":"Step-Audio: Unified Understanding and Generation in Intelligent Speech Interaction","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.11946","snapshot_observed_at":"2026-08-15T20:06:43.523035Z","title":"Step-audio: Unified understanding and generation in intelligent speech interaction,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.523035Z"},"links":{"cited_paper":"/paper/2502.11946","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:bcc12ec7284a038c96307b349dddafbb1363d50c47fa3a428c8e9778dac34e7b","observation_id":"77ab0085-4518-4520-a271-046dce8fd0e1","resolution":{"observed_at":"2026-08-15T20:06:43.523035Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.526627Z","title":"Wavlm: Large-scale self- supervised pre-training for full stack speech processing,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.526627Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:dc9ab3cc0016a25eb1a36b27bea7de85527520356e8f4f54fe08698356894312","observation_id":"9ae72381-d0ee-4d7d-8338-8311f8af4dea","resolution":{"observed_at":"2026-08-15T20:06:43.526627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.790791Z","title":"Promptasr for contextualized asr with controllable style,","venue":null,"work_id":"15882006-7bf2-4261-b6c7-998e4e982842","year":2024},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.530452Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:c154caf4b9563e39516340e9628c136e0e2fdca481fed44ed6837981c805c873","observation_id":"d69eb4bc-fc52-4a1e-906d-b49cd2e9f126","resolution":{"observed_at":"2026-08-15T20:06:43.795225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-15T20:06:43.533954Z","title":"A survey on in-context learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.533954Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:232fd8a6ee719b0c115e0d65ae0f37f3ed4773d34c839242e31a19d6d7c600a4","observation_id":"f32fa37a-b90b-41e7-9f6b-ed62a8e0e4ef","resolution":{"observed_at":"2026-08-15T20:06:43.533954Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.778325Z","title":"Mozilla Common V oice 21.0,","venue":null,"work_id":"3c17ad3b-4599-465c-a598-25df88804237","year":2025},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.537592Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:e3e741e16deb775f3fab6ebf04d6cfb47688744e29e86bfa6d3d26b583894cec","observation_id":"eccc7cb4-d0b4-4d9c-8374-b94da26e1460","resolution":{"observed_at":"2026-08-15T20:06:43.782340Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-15T20:06:43.540812Z","title":"Gemma 2: Improving open language models at a practical size,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.540812Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:b1205e0a08b1341bc20b8241844dd792354e999f18eb26b27fadddf8cbc7593a","observation_id":"09b15b92-4fe7-4e58-96a2-708bce2116a8","resolution":{"observed_at":"2026-08-15T20:06:43.540812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T20:06:43.544143Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.544143Z"},"links":{"citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:7f1cf3cf9b13ae2ac4e3f0e0a9a32452af822fe77d19dce3a2d8d9498523a17d","observation_id":"3055bc9f-80c6-4bb7-b9b8-4c149cdacd4c","resolution":{"observed_at":"2026-08-15T20:06:43.544143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.08846","last_updated":"2024-02-13T23:25:04Z","snapshot_observed_at":"2026-08-16T14:18:48.581750Z","submitted_at":"2024-02-13T23:25:04Z","title":"An Embarrassingly Simple Approach for LLM with Strong ASR Capacity","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.08846","snapshot_observed_at":"2026-08-15T20:06:43.547983Z","title":"An embarrassingly simple approach for llm with strong asr capacity,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T20:06:43.547983Z"},"links":{"cited_paper":"/paper/2402.08846","citing_paper":"/paper/2506.13396"},"observation_digest":"sha256:d836622d1db1464431aa4c7a135df0c0fc8aac2cb6af80d62662c0a12c428880","observation_id":"bdef3d38-819e-4637-9a6f-83a83a4c9249","resolution":{"observed_at":"2026-08-15T20:06:43.547983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.13396","last_updated":"2025-07-04T04:11:53Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-15T20:00:23.176461Z","submitted_at":"2025-06-16T12:03:23Z","title":"Bi-directional Context-Enhanced Speech Large Language Models for Multilingual Conversational ASR"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 1 inbound Pith citation observation for arXiv:2506.13396."}