{"as_of":"2026-08-10T17:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:00eff9c6481ae5dab807ee695cfe47f64b6e71fae65481d4118e1f30a8b02faf","coverage":[{"denominator":28,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":28,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:42:24.102738Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-10T06:31:04.303077+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T22:42:22.092467Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-10T12:15:01.137692Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02927","snapshot_observed_at":"2026-08-06T22:42:22.092467Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.092467Z"},"links":{"cited_paper":"/paper/2507.02927","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:2ec95614efde4587a420886db351d12cb05cd3c21efdbe1fce1c3143f2e8c00f","observation_id":"972f97d3-9aa0-413e-9205-bbe5055e1865","resolution":{"observed_at":"2026-08-06T22:42:22.092467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02927","snapshot_observed_at":"2026-08-03T11:20:26.133225Z","title":"on Mandarin Chinese","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.06896","last_updated":"2026-07-13T07:08:04Z","snapshot_observed_at":"2026-08-08T23:12:40.627454Z","submitted_at":"2026-01-11T12:40:07Z","title":"TagSpeech: End-to-End Multi-Speaker ASR and Diarization with Fine-Grained Temporal Grounding","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T11:20:26.133225Z"},"links":{"cited_paper":"/paper/2507.02927","citing_paper":"/paper/2601.06896"},"observation_digest":"sha256:8d52edb4f93a3ecdf74bc69319076308e90813144566eeb020cbea258035592b","observation_id":"70734772-557a-45b5-a43f-d1ba4654f39e","resolution":{"observed_at":"2026-08-03T11:20:26.133225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"cited_work":{"arxiv_id":"2507.02927","doi":"10.48550/arxiv.2507.02927","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.02927","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":null,"venue":null,"work_id":"e20d99fc-7755-4994-9730-0a01d05480fd","year":null},"citing_paper":{"arxiv_id":"2606.11219","last_updated":"2026-05-11T20:27:40Z","snapshot_observed_at":"2026-08-05T20:46:41.277498Z","submitted_at":"2026-05-11T20:27:40Z","title":"Afrispeech Semantics: Evaluating Audio Semantic Reasoning in Spoken Language Models Across Domains and Accents","version":1},"reference_index":225,"source":"arxiv_source","source_observed_at":"2026-06-30T22:11:44.891731Z"},"links":{"cited_paper":"/paper/2507.02927","citing_paper":"/paper/2606.11219"},"observation_digest":"sha256:e5126323ad3e61b48c66ea81e880123016b442f4b9229d86bcfb93c8f1362554","observation_id":"7f865227-8a05-423f-aad1-44781ffca4ee","resolution":{"observed_at":"2026-06-30T22:15:05.534150Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.02927/citation-record","integrity":"/paper/2507.02927/integrity","json":"/paper/2507.02927/citation-record.json","paper":"/paper/2507.02927"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:26.913592Z","title":null,"venue":null,"work_id":"21798fc4-63c0-46a3-a009-518cc6c14a6e","year":null},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.023549Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:7259aba0d5403a0e20bb6a4bfaccbc11cc2d8d76884de141174661c21a69f3c1","observation_id":"131ec8f9-b6ac-4ff5-85bf-65484850585e","resolution":{"observed_at":"2026-08-06T22:42:26.973167Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.02927","snapshot_observed_at":"2026-08-06T22:42:22.092467Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.092467Z"},"links":{"cited_paper":"/paper/2507.02927","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:2ec95614efde4587a420886db351d12cb05cd3c21efdbe1fce1c3143f2e8c00f","observation_id":"972f97d3-9aa0-413e-9205-bbe5055e1865","resolution":{"observed_at":"2026-08-06T22:42:22.092467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:26.784663Z","title":null,"venue":null,"work_id":"d07a285b-4ecc-4b94-ba2f-db47e72ed2cc","year":null},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.175244Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:7de0c524910049c1dae56ffe0a4cf83126dbcdb4697d3eb78b3eaabf9c6808fa","observation_id":"613fb2ed-1c0f-4087-bbd9-e5fb87e779b8","resolution":{"observed_at":"2026-08-06T22:42:26.840424Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:26.647574Z","title":null,"venue":null,"work_id":"4bd29348-bdd6-4eb9-b64a-45dda11157da","year":null},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.234082Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:4a18e22ad6fab1639c354b51377486a56a0303d059ce9ba3c7041dae2a61c109","observation_id":"66bf273c-1e06-4d56-afe4-6fd84053bc88","resolution":{"observed_at":"2026-08-06T22:42:26.707120Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:26.525432Z","title":null,"venue":null,"work_id":"3d851f06-278e-40a4-9c02-8a1afe4cb275","year":null},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.359265Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:f7c78a913b7be93d8f624a9a4a415ad81a003742651ca6e6f64b669563d3441f","observation_id":"1558d73b-2462-4bef-ab43-9a2e4717d999","resolution":{"observed_at":"2026-08-06T22:42:26.566568Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:26.370695Z","title":"MLC-SLM Challenge: Multilingual conversational speech language model at interspeech 2025,","venue":null,"work_id":"b4837200-60bc-4dbc-887a-9320ab2a60a7","year":2025},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.408613Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:88995f922fbeb93caaa4a9edbae1be7a2233b9b6dbe0983e85b9f497878d1df7","observation_id":"f5e688c0-7e52-45eb-873c-7744720a65c6","resolution":{"observed_at":"2026-08-06T22:42:26.423917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:26.265181Z","title":"Mlc-slm baseline,","venue":null,"work_id":"59133b9b-f119-42b7-9768-0a6bda4120e5","year":2025},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.508093Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:d6cf6714234706a248b45ed3915c35fdb70145a225dceb3416c2356b9fa6187a","observation_id":"0d096d98-faab-4ca7-889b-11ccfb0be2ef","resolution":{"observed_at":"2026-08-06T22:42:26.307532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:26.072502Z","title":"One model to rule them all ? towards end-to-end joint speaker diarization and speech recognition,","venue":null,"work_id":"8b755ae8-c1f4-41b6-8674-4eb582c1a7d6","year":2024},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.611403Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:3dc5861745ea9d0c4ab37109167e3243b1a0f39341c5418c564d51d49c8a1eb3","observation_id":"a032a453-4cde-4bb0-9a3a-b7328767e311","resolution":{"observed_at":"2026-08-06T22:42:26.159257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.06656","last_updated":"2025-07-19T18:18:34Z","snapshot_observed_at":"2026-07-06T19:13:20.458958Z","submitted_at":"2024-09-10T17:20:11Z","title":"Sortformer: A Novel Approach for Permutation-Resolved Speaker Supervision in Speech-to-Text Systems","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.06656","snapshot_observed_at":"2026-08-06T22:42:22.701392Z","title":"Sortformer: Seamless integration of speaker diarization and asr by bridging timestamps and tokens,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.701392Z"},"links":{"cited_paper":"/paper/2409.06656","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:728f93101a36a607b9d2f5776bf9b5e5a1c9dd70ef73b6d3d41a09605fe016e0","observation_id":"ba6a276c-475e-4e45-ac1e-57f0e35844b8","resolution":{"observed_at":"2026-08-06T22:42:22.701392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-10T16:40:37.411115Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T22:42:22.756454Z","title":"The llama 3 herd of models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.756454Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:e4c3dd096e9f32fb122bad84d3817cd526ba3345671f0a0ffadd2fd8f47d1a16","observation_id":"be1a69f3-b89b-413c-8068-a96f57cc53e7","resolution":{"observed_at":"2026-08-06T22:42:22.756454Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:25.874086Z","title":"Llama-3.2-3b-instruct,","venue":null,"work_id":"58e2bd18-3865-4956-95c3-fb9fa9f10eda","year":2024},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.862696Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:753fee2f881ab75c2f94648bbc7356b8df76f4418d4629fa16be1de411f5a6f3","observation_id":"4457049d-35be-438b-acd3-1c944c089540","resolution":{"observed_at":"2026-08-06T22:42:25.977996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:25.715635Z","title":"Llama-3.1-8b,","venue":null,"work_id":"a0ef7b05-4dca-4659-b65e-4d5c22a95d9b","year":2024},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:22.918124Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:878f73bb14de070a2bf9dc539392379db3784c32f0c83f9a388ddb5cf972e6ad","observation_id":"0e0d6f22-d59f-48af-b2fb-9667a25e1f2c","resolution":{"observed_at":"2026-08-06T22:42:25.772995Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-07T07:43:16.294957Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-06T22:42:23.010828Z","title":"Lora: Low-rank adaptation of large lan- guage models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.010828Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:6204c79bb04fabe0d8b3e2f2fa83be29351ba14fc93e1db803519b75d30acf04","observation_id":"00caef1b-0780-405b-80ee-7970997b23b5","resolution":{"observed_at":"2026-08-06T22:42:23.010828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.04356","last_updated":"2022-12-06T18:46:04Z","snapshot_observed_at":"2026-07-06T14:28:21.844826Z","submitted_at":"2022-12-06T18:46:04Z","title":"Robust Speech Recognition via Large-Scale Weak Supervision","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.04356","snapshot_observed_at":"2026-08-06T22:42:23.077634Z","title":"Robust speech recognition via large-scale weak supervision,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.077634Z"},"links":{"cited_paper":"/paper/2212.04356","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:78e5f8c6af84b4d5ac6ce16cf870106f99ddc41a2ef4d56d3277f3a21c63f36d","observation_id":"d8254148-5783-49b6-b7a7-bfba91d4b099","resolution":{"observed_at":"2026-08-06T22:42:23.077634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:23.112256Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.112256Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:d935353264801a463bcd2a30a4a9030ebe629c5ce40ce6ba355fe1bf337ff1fd","observation_id":"9de5b9ed-1ea3-4f79-b3e9-a20d81d1b7c9","resolution":{"observed_at":"2026-08-06T22:42:23.112256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1606.08415","last_updated":"2023-06-06T01:53:32Z","snapshot_observed_at":"2026-07-06T05:01:27.910364Z","submitted_at":"2016-06-27T19:20:40Z","title":"Gaussian Error Linear Units (GELUs)","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1606.08415","snapshot_observed_at":"2026-08-06T22:42:23.215615Z","title":"Bridging nonlinearities and stochastic regularizers with gaussian error linear units,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.215615Z"},"links":{"cited_paper":"/paper/1606.08415","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:d13f18ce7201422a1a9c96a67ac118f40e7593c6c2117c2ab040bc179bfbb396","observation_id":"2429ca22-968e-4162-89f7-72ac7fd86c1e","resolution":{"observed_at":"2026-08-06T22:42:23.215615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:25.496066Z","title":"Deep learning using rectified linear units (relu),","venue":null,"work_id":"e7c086ec-4706-463d-868a-8c8cb42733a7","year":null},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.271600Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:cc3e26367995411688a99aaa0193f2c893db02594ddac102534a3b8a80b2959d","observation_id":"94d9383e-01bb-490f-97ff-cdf718ed9599","resolution":{"observed_at":"2026-08-06T22:42:25.626964Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:24.705838Z","title":"Cam++: A fast and efficient network for speaker verification using context- aware masking,","venue":null,"work_id":"f9bf45fb-b4d5-4a47-870d-0bb7ac296e21","year":2023},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.926312Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:d7240846515b90e2dd7bd9b0fdb3db1e2298c3510ef7eb61f9520ca8eaec61bc","observation_id":"8cdc420f-ec55-4185-b29f-0836110cb1f7","resolution":{"observed_at":"2026-08-06T22:42:24.809117Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:25.320020Z","title":"Layer normalization,","venue":null,"work_id":"8a8525fa-6181-4eb1-9125-c573fe817744","year":null},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.430353Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:341d488bf51a88844c979c1b0d4c47f77fbc49ea4054bc55f15eccbc47cff302","observation_id":"7034c702-516b-4d5c-927e-e5e5559d3b38","resolution":{"observed_at":"2026-08-06T22:42:25.398028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-09T20:34:52.923500Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-06T22:42:24.055127Z","title":"Decoupled weight decay regulariza- tion,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:24.055127Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:1b01bcb3e38efb275545a345e4970916802ae7b7fbc6cd987adcd8f857ae24b0","observation_id":"486eb58d-5e5a-4076-bc2f-1ba72c2a48a1","resolution":{"observed_at":"2026-08-06T22:42:24.055127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:25.190827Z","title":"Specaugment: A simple data augmentation method for automatic speech recognition,","venue":null,"work_id":"46885b5b-4069-48e4-975d-714a9f4fb179","year":2019},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.633767Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:01f9407d4a84d9314174e4c34de17e8133ef7a2320092e607eca83a4c384f81e","observation_id":"f0b1c17c-01ba-4e8d-8fc3-0a7641dd45b7","resolution":{"observed_at":"2026-08-06T22:42:25.237377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.05642","last_updated":"2021-12-30T00:30:30Z","snapshot_observed_at":"2026-08-04T06:59:25.324887Z","submitted_at":"2021-06-10T10:25:15Z","title":"U2++: Unified Two-pass Bidirectional End-to-end Model for Speech Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.05642","snapshot_observed_at":"2026-08-06T22:42:23.720920Z","title":"U2++: Unified two-pass bidirectional end-to- end model for speech recognition,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.720920Z"},"links":{"cited_paper":"/paper/2106.05642","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:ae08f82b88d96ebc3282c5d099d7862f7fbaeaabfd15fd29392b9ce4a93d7f44","observation_id":"fd896728-cf7c-4fe3-9ea2-445fea9238c8","resolution":{"observed_at":"2026-08-06T22:42:23.720920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:25.085704Z","title":"MeetEval: A toolkit for computation of word error rates for meeting transcription systems,","venue":null,"work_id":"0d149c62-ea94-4048-8579-e6dfe23cd6c9","year":2023},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.775090Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:57f232edee5de91d69e6d06aa36ba5bdcd9311f7e6eea84766ffeb6e4753cff0","observation_id":"76e558a2-1e79-47eb-b161-d34396e82d53","resolution":{"observed_at":"2026-08-06T22:42:25.138961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:24.892416Z","title":"Llama-3.2-1b-instruct,","venue":null,"work_id":"821f54ea-617f-4102-8c81-a20a9d6bac1a","year":2024},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.817384Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:79a0cc4b3afb410a08065d3bbb5193dd7ed7a791a0ac954adc085e77c561b0bd","observation_id":"887ff142-7eac-477a-afcc-2dbf54c6ad69","resolution":{"observed_at":"2026-08-06T22:42:24.955834Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:24.570584Z","title":"Phi-4-multimodal-instruct: Lightweight open multimodal foundation model with text, im- age, and audio inputs,","venue":null,"work_id":"11e588a5-e9e9-4098-8e5e-a13670b291fd","year":2025},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.985251Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:d4121b141fd3aa3f759e2733287da3baee636ba40353158055f5a225828576ec","observation_id":"6a1226b5-a830-44c5-bffa-5e91f6043196","resolution":{"observed_at":"2026-08-06T22:42:24.642017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T22:42:24.418434Z","title":"Phi-4-multimodal-finetune-KO-speech: A ko- rean speech-to-text fine-tuned model based on phi-4 mul- timodal,","venue":null,"work_id":"5e031e48-82a0-4db1-aebb-d8355fc021ef","year":2025},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:24.102738Z"},"links":{"citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:9ec42258374d842b6b896e4c7fb36bd193e99e145c8be86d52487738d09d472c","observation_id":"5a18d2db-20f7-4068-8387-0cd374a02e8c","resolution":{"observed_at":"2026-08-06T22:42:24.464893Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-10T06:31:04.303077+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-06T22:42:23.501469Z","title":"Available: https://arxiv.org/abs/1607.06450","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.501469Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:2ce02daea5f61f01c1a855ef65e1661df786000fd7289321a06ab427c09d90af","observation_id":"e9509a76-cff3-49d6-9ab8-ced3f31519b3","resolution":{"observed_at":"2026-08-06T22:42:23.501469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.08375","last_updated":"2026-04-14T12:21:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-03-22T14:30:17Z","title":"Deep Learning using Rectified Linear Units (ReLU)","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.08375","snapshot_observed_at":"2026-08-06T22:42:23.349608Z","title":"Available: https://arxiv.org/abs/1803.08375","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-06T22:42:23.349608Z"},"links":{"cited_paper":"/paper/1803.08375","citing_paper":"/paper/2507.02927"},"observation_digest":"sha256:00c21b91516f6e70018b3f3f4fb6e5574047bf6b68e19866b4d814f085cafdd7","observation_id":"6e5df7ac-4f4a-4600-8efa-cbd1e3b62c98","resolution":{"observed_at":"2026-08-06T22:42:23.349608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.02927","last_updated":"2025-06-26T01:54:02Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T23:12:02.757913Z","submitted_at":"2025-06-26T01:54:02Z","title":"A Unified Speech LLM for Diarization and Speech Recognition in Multilingual Conversations"},"reference_resolution":{"displayed":28,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":28},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-10T06:31:04.303077+00:00","source":"crossref"},{"observed_at":"2026-08-10T06:30:57.382061+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 28 of 28 outbound references and 3 inbound Pith citation observations for arXiv:2507.02927."}