{"as_of":"2026-08-13T12:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:74afda999f5b414bc501add79de9e6da54fa84ab9b95192472aded6012c67b92","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T19:39:02.680071Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T00:33:55.288126Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-12T00:33:55.349765Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.09174","snapshot_observed_at":"2026-08-01T07:12:17.843112Z","title":"arXiv preprint arXiv:2509.09174 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21550","last_updated":"2026-07-23T17:35:20Z","snapshot_observed_at":"2026-08-13T09:55:09.197044Z","submitted_at":"2026-07-23T17:35:20Z","title":"X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment","version":1},"reference_index":204,"source":"arxiv_source","source_observed_at":"2026-08-01T07:12:17.843112Z"},"links":{"cited_paper":"/paper/2509.09174","citing_paper":"/paper/2607.21550"},"observation_digest":"sha256:7dd328c65df757ae3ba5e30b9a5da89b9718fdde61ad20aca86ae755ae5287a2","observation_id":"8346690a-1027-4b5d-a419-4f65f6cab15d","resolution":{"observed_at":"2026-08-01T07:12:17.843112Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"cited_work":{"arxiv_id":"2509.09174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2509.09174","snapshot_observed_at":"2026-08-12T00:33:55.349765Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","venue":"cs.CL","work_id":"b2c460aa-4384-46e4-9d85-f0a179a7b9b7","year":2025},"citing_paper":{"arxiv_id":"2608.08067","last_updated":"2026-08-08T11:11:10Z","snapshot_observed_at":"2026-08-13T12:11:59.730862Z","submitted_at":"2026-08-08T11:11:10Z","title":"DialectS2S: End-to-End Speech Dialogue Modeling for Low-Resource Chinese Dialects","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T00:33:55.288126Z"},"links":{"cited_paper":"/paper/2509.09174","citing_paper":"/paper/2608.08067"},"observation_digest":"sha256:eb9628cd205283976c3ab361012ddb3c755fc5ffd2618657a79b2806f1d591fa","observation_id":"fc5570f9-6f3e-4de1-a5c6-7576b8b645f1","resolution":{"observed_at":"2026-08-12T00:33:55.353666Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2509.09174/citation-record","integrity":"/paper/2509.09174/integrity","json":"/paper/2509.09174/citation-record.json","paper":"/paper/2509.09174"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:00.629162Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:00.629162Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:3daefa87cc8383e224390233e7ba2f4fe19c6727a68ff060577b361bf85cc36e","observation_id":"2fecbff7-c974-4cdd-a52f-4a7c0d0035de","resolution":{"observed_at":"2026-08-04T19:39:00.629162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:00.694928Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:00.694928Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:61ace8562383341288776eac24f6f94de823805f1cf7a7f0e0f5c0e038c0b833","observation_id":"60d92170-be2f-4e05-9c5e-7c4ecbb2e01f","resolution":{"observed_at":"2026-08-04T19:39:00.694928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:00.775798Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:00.775798Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:a9d26335a0fda42ce437434e467bace818fd469e7ced13ae187c80d575402491","observation_id":"ef9c3d26-f8d6-4bce-9d4b-543003226829","resolution":{"observed_at":"2026-08-04T19:39:00.775798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:00.867444Z","title":"Sorry, I cannot answer this question","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:00.867444Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:d1526ef6c67c69ba488e45caa28a54dd42e379409e88ddc912c9d7414c8fc0f8","observation_id":"1bafcd00-62fa-42a5-8f28-4f0a3c16e434","resolution":{"observed_at":"2026-08-04T19:39:00.867444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:00.945102Z","title":"** Example: ‘‘‘ User: Hello Assistant: Hello User: Hello Assistant: Hello ‘‘‘","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:00.945102Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:3b75357e12f6fe83e75ddc78b34c60086374717ed071b73c8f13df94116e7d60","observation_id":"e6e4da73-affc-40f6-8f93-b3704ef1f741","resolution":{"observed_at":"2026-08-04T19:39:00.945102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:01.034702Z","title":"SensitiveContentJudgment","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:01.034702Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:4804ced823520f6ccb9df0860dff0e1758fc98f2857d2da419303a4b5a83bd54","observation_id":"4a4da579-eb12-4ae6-995d-aa90f5c83af9","resolution":{"observed_at":"2026-08-04T19:39:01.034702Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:01.123649Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:01.123649Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:e7e0fec712c41dd15bba4cf1e4144a74989cbe877e502b19f5854406e3c5a6b6","observation_id":"e5a458e4-417d-4137-a71b-df1dc1d8f7dd","resolution":{"observed_at":"2026-08-04T19:39:01.123649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:01.200726Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:01.200726Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:1024eb835869ce5d8678525784110e71e9a98dd053909ec25c3381f4d5b2cdb1","observation_id":"35162572-42c4-4864-bccd-f0bdc3dc16a6","resolution":{"observed_at":"2026-08-04T19:39:01.200726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:01.289636Z","title":"judgement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:01.289636Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:dfecbb9899b536acbf7c283a7f7cdc886de69e7f481805d01d19f085adfb8c1e","observation_id":"096b6e25-c023-462a-a6aa-773f284d6ede","resolution":{"observed_at":"2026-08-04T19:39:01.289636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:01.403747Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:01.403747Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:222b12eaec3b00e3556d87039dcf0866234c918b329cbe75b2e3ba024f81a91f","observation_id":"82b45042-3b23-4625-8dce-e308393d1ffd","resolution":{"observed_at":"2026-08-04T19:39:01.403747Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:01.458891Z","title":"I used to play that game a lot when I was young","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:01.458891Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:cfa8d7f75972ce329720df81aabff5b7a5d285e67dae2a405ed770ee0ca7ea10","observation_id":"b1da3a39-71f6-4ef5-a11e-85373491f6e9","resolution":{"observed_at":"2026-08-04T19:39:01.458891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:01.631098Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:01.631098Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:06b9565e22c0373a3b03e1bf1f78cd076d677ecc6bcf5c1da396a84ad1460630","observation_id":"1d3de36c-576c-4e2a-88af-a82cddd4b816","resolution":{"observed_at":"2026-08-04T19:39:01.631098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:01.745116Z","title":"judgement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:01.745116Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:ff9d78a522899c7927def871c160b510b3396c6ecb0d160593e6fc3845d764f6","observation_id":"a2bfdc2f-122b-4d69-ae8b-3c639c0f6bf4","resolution":{"observed_at":"2026-08-04T19:39:01.745116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:01.903120Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:01.903120Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:40bb29500d8ec99dd3c09e585fca2787d24c7dd3ff3e36d1c496ad02120ed025","observation_id":"596e9501-9cb9-4019-b0bc-0a1c00987117","resolution":{"observed_at":"2026-08-04T19:39:01.903120Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:01.948213Z","title":"judgement","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:01.948213Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:940708c6589356d40399dae22fba9989ef2e1409ae2f25e968325b0b02f0748f","observation_id":"102ae36e-56c8-4cfc-9979-4dd1bc122404","resolution":{"observed_at":"2026-08-04T19:39:01.948213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:02.097032Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:02.097032Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:d2f2a030164beaa2873a961407140c5a9c46f7610bafff97827ad43176735020","observation_id":"245a699d-aa65-4952-9615-0e14f728de09","resolution":{"observed_at":"2026-08-04T19:39:02.097032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:02.175018Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:02.175018Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:3b11413774da36015924414b68a94f04a19217bf5bde5540da313f932362324f","observation_id":"bc0f62b1-2f51-4445-8377-d18c8298121d","resolution":{"observed_at":"2026-08-04T19:39:02.175018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:02.278921Z","title":"judgement","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:02.278921Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:c45213e3851e6ffc8edc0bc3bb7feae1bc7511984fc35730259927b94802ab7c","observation_id":"9912312b-fa6f-4914-b8ed-ec63ce69a4a9","resolution":{"observed_at":"2026-08-04T19:39:02.278921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:02.410457Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:02.410457Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:428476411596eab99d19163f1d61c1012b1ada89c911b414cebbcc11d38c4a86","observation_id":"b7b8e75b-fe39-4742-81f4-a96525a77954","resolution":{"observed_at":"2026-08-04T19:39:02.410457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:02.563400Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:02.563400Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:a74483cf353be65bfb26fcec6ba682ab16ab6c2bdd81cc65cee00f0f474e9d06","observation_id":"c9731370-54b2-4491-8640-22ebf4681e6f","resolution":{"observed_at":"2026-08-04T19:39:02.563400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-04T19:39:02.680071Z","title":"conversations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:02.680071Z"},"links":{"citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:b2c523eebceb27305d210ed0892212f506c49f7c7667c6716bc22a69796b9fd0","observation_id":"aa9eec0c-37f4-497b-835a-449737301904","resolution":{"observed_at":"2026-08-04T19:39:02.680071Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10759","last_updated":"2024-07-15T14:38:09Z","snapshot_observed_at":"2026-08-13T05:33:22.244747Z","submitted_at":"2024-07-15T14:38:09Z","title":"Qwen2-Audio Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10759","snapshot_observed_at":"2026-08-04T19:39:00.550231Z","title":"ran- dom access memory","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-04T19:39:00.550231Z"},"links":{"cited_paper":"/paper/2407.10759","citing_paper":"/paper/2509.09174"},"observation_digest":"sha256:d6cb4522f675bf426e33bf902e803029363180c740be9309b73c96f321e83703","observation_id":"4640a396-776f-433b-a213-53860297e563","resolution":{"observed_at":"2026-08-04T19:39:00.550231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2509.09174","last_updated":"2025-09-11T06:17:59Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-12T16:29:27.032616Z","submitted_at":"2025-09-11T06:17:59Z","title":"EchoX: Towards Mitigating Acoustic-Semantic Gap via Echo Training for Speech-to-Speech LLMs"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 2 inbound Pith citation observations for arXiv:2509.09174."}