{"as_of":"2026-08-22T23:44:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:6614c076d625ef972a9a6cb25b5659ff67a2c95b7c53ac445099bd7c8ce42dda","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T10:17:43.884961Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-07T14:53:55.794102Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":"2503.01174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-07T14:53:55.794102Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics","venue":"cs.CL","work_id":"ceeb072e-0415-4508-999c-bcb728f2e57a","year":2025},"citing_paper":{"arxiv_id":"2504.13898","last_updated":"2026-05-12T14:42:20Z","snapshot_observed_at":"2026-08-15T21:58:56.996558Z","submitted_at":"2025-04-07T06:27:02Z","title":"Social Human Robot Embodied Conversation (SHREC) Dataset: Benchmarking Foundational Models' Social Reasoning","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-22T21:14:13.351140Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2504.13898"},"observation_digest":"sha256:e41728cd3ba72ec05a70cdf56fef163188cb16225b26094eb08918615b0b171a","observation_id":"2a68bdae-f164-4ca5-9802-5acdc0db4668","resolution":{"observed_at":"2026-05-22T21:15:09.419799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-08-07T10:17:43.884961Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.10019","last_updated":"2025-06-06T11:09:46Z","snapshot_observed_at":"2026-08-17T19:45:22.860227Z","submitted_at":"2025-06-06T11:09:46Z","title":"A Survey of Automatic Evaluation Methods on Text, Visual and Speech Generations","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T10:17:43.884961Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2506.10019"},"observation_digest":"sha256:0965fd52ec2df9e584ee7a87269ea7d102e09ed7659a76bd7af69d543ccd6aac","observation_id":"511a8d1a-3a6c-4541-a13e-8c576cc4a2b3","resolution":{"observed_at":"2026-08-07T10:17:43.884961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-08-05T10:25:14.922048Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.04093","last_updated":"2025-09-04T10:49:51Z","snapshot_observed_at":"2026-08-18T04:02:36.247629Z","submitted_at":"2025-09-04T10:49:51Z","title":"Open-Source Full-Duplex Conversational Datasets for Natural and Interactive Speech Synthesis","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:25:14.922048Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2509.04093"},"observation_digest":"sha256:4299baa81f4b221c11982a75b32a77aba42ad719bdf37685eb3a0dd47a6b20fa","observation_id":"814cd09c-f793-44f0-89df-7228590b643e","resolution":{"observed_at":"2026-08-05T10:25:14.922048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-08-03T00:56:57.191255Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics.arXiv preprint arXiv:2503.01174, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.11065","last_updated":"2026-05-28T11:37:06Z","snapshot_observed_at":"2026-08-12T06:47:36.412262Z","submitted_at":"2026-02-11T17:32:52Z","title":"S-MARC: Causal Streaming Reasoning for Full-Duplex Conversational Behavior Modeling","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T00:56:57.191255Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2602.11065"},"observation_digest":"sha256:3472a2de50b406a30d0bd16d5820d217a7e05d39265e70dfeeff3a587eac00ac","observation_id":"a6902974-2fde-4daa-953f-5945ace59d2f","resolution":{"observed_at":"2026-08-03T00:56:57.191255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-13T23:27:58.971096Z","title":"Talking turns: Bench- marking audio foundation models on turn-taking dynamics.arXiv preprint arXiv:2503.01174, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16859","last_updated":"2026-07-01T09:16:52Z","snapshot_observed_at":"2026-08-12T16:11:36.690343Z","submitted_at":"2026-03-17T17:58:44Z","title":"SocialOmni: Benchmarking Audio-Visual Social Interactivity in Omni Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T23:27:58.971096Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2603.16859"},"observation_digest":"sha256:87853e9f0f99e4620bf17f116abc9970f460e58696b66a59ae16af139feeb988","observation_id":"84685f6f-9317-4a1b-8567-254e4f5817d4","resolution":{"observed_at":"2026-07-13T23:27:58.971096Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":"2503.01174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-07T14:53:55.794102Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics","venue":"cs.CL","work_id":"ceeb072e-0415-4508-999c-bcb728f2e57a","year":2025},"citing_paper":{"arxiv_id":"2605.20266","last_updated":"2026-05-18T20:21:32Z","snapshot_observed_at":"2026-08-16T00:00:14.809961Z","submitted_at":"2026-05-18T20:21:32Z","title":"A Survey of Large Audio Language Models: Generalization, Trustworthiness, and Outlook","version":1},"reference_index":183,"source":"pdf_text","source_observed_at":"2026-05-21T07:38:23.099479Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2605.20266"},"observation_digest":"sha256:f62f50e5a7212be7b9b4c275c2e040de096c93d7ac5fb2afa28ad86abd53dafe","observation_id":"70d42228-07f0-41a3-9d55-7c4603f3a435","resolution":{"observed_at":"2026-05-21T07:39:48.647080Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":"2503.01174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-07T14:53:55.794102Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics","venue":"cs.CL","work_id":"ceeb072e-0415-4508-999c-bcb728f2e57a","year":2025},"citing_paper":{"arxiv_id":"2605.20755","last_updated":"2026-06-11T05:13:51Z","snapshot_observed_at":"2026-08-17T17:49:50.443103Z","submitted_at":"2026-05-20T05:54:08Z","title":"DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-21T02:41:13.583493Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2605.20755"},"observation_digest":"sha256:6227f5b7a4e5aa3e65a80159348dcf6a0e9a12024191492da79d4a73227a87ae","observation_id":"e08aec35-b333-4e3c-9b1b-f2e6aa3bd14a","resolution":{"observed_at":"2026-05-21T02:43:55.016893Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":"2503.01174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-07T14:53:55.794102Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics","venue":"cs.CL","work_id":"ceeb072e-0415-4508-999c-bcb728f2e57a","year":2025},"citing_paper":{"arxiv_id":"2605.20755","last_updated":"2026-06-11T05:13:51Z","snapshot_observed_at":"2026-08-17T17:49:50.443103Z","submitted_at":"2026-05-20T05:54:08Z","title":"DuplexSLA: A Full-Duplex Spoken Language Model with Synchronized Speech, Language, and Action","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T17:32:58.848455Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2605.20755"},"observation_digest":"sha256:2dca86e830c8afc5fdcf8bd208780788404ad24b6810575024f835c969d64e81","observation_id":"44d56285-f5f5-4bc4-b632-72ac5a7c9ad5","resolution":{"observed_at":"2026-06-30T17:34:57.383937Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":"2503.01174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-07T14:53:55.794102Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics","venue":"cs.CL","work_id":"ceeb072e-0415-4508-999c-bcb728f2e57a","year":2025},"citing_paper":{"arxiv_id":"2606.13544","last_updated":"2026-06-26T09:33:27Z","snapshot_observed_at":"2026-07-06T23:52:18.996096Z","submitted_at":"2026-06-11T16:27:45Z","title":"Adaptive Turn-Taking for Real-time Multi-Party Voice Agents","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T05:32:27.371597Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2606.13544"},"observation_digest":"sha256:44892243099985f7a414206af934d584727c62d36e21fbd3811d8b6028f2a445","observation_id":"04e054a2-92c9-4bde-b67b-f5b1f7662ed6","resolution":{"observed_at":"2026-07-03T16:28:39.492855Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":"2503.01174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-07T14:53:55.794102Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics","venue":"cs.CL","work_id":"ceeb072e-0415-4508-999c-bcb728f2e57a","year":2025},"citing_paper":{"arxiv_id":"2606.13544","last_updated":"2026-06-26T09:33:27Z","snapshot_observed_at":"2026-07-06T23:52:18.996096Z","submitted_at":"2026-06-11T16:27:45Z","title":"Adaptive Turn-Taking for Real-time Multi-Party Voice Agents","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-29T05:01:44.202712Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2606.13544"},"observation_digest":"sha256:9b3bcbc1e08854413ca41abf8f8101c89b7b80665724dd44311136679c7ff6d2","observation_id":"fd89cee1-7f87-4725-a7bb-0cd91dc90c52","resolution":{"observed_at":"2026-06-29T18:43:51.432668Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":"2503.01174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-07T14:53:55.794102Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics","venue":"cs.CL","work_id":"ceeb072e-0415-4508-999c-bcb728f2e57a","year":2025},"citing_paper":{"arxiv_id":"2606.19453","last_updated":"2026-06-17T18:00:08Z","snapshot_observed_at":"2026-08-12T18:49:26.971639Z","submitted_at":"2026-06-17T18:00:08Z","title":"A Survey of Full-Duplex Spoken Dialogue Systems: Architectural Hierarchy, Interaction Ontology, and Decision State Machine","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-26T19:02:16.119373Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2606.19453"},"observation_digest":"sha256:9b4e0027944b95af66243d0067a7a35424ef8608a9d0db007b494fa9b327cbbc","observation_id":"0e1281f3-4fb8-42f9-8731-b258e47814ed","resolution":{"observed_at":"2026-07-04T02:49:25.019234Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":"2503.01174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-07T14:53:55.794102Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics","venue":"cs.CL","work_id":"ceeb072e-0415-4508-999c-bcb728f2e57a","year":2025},"citing_paper":{"arxiv_id":"2607.01345","last_updated":"2026-07-05T19:53:45Z","snapshot_observed_at":"2026-08-14T10:16:36.384280Z","submitted_at":"2026-07-01T18:03:09Z","title":"TurnNat: Automatic Evaluation of Turn-Taking Naturalness in Dyadic Spoken Dialogue","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-03T21:22:38.888528Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2607.01345"},"observation_digest":"sha256:9723a1744bcd4b04d259bb9e8f820c5ccf7b97efb5d7145c2c8edde7bbbae954","observation_id":"bb848000-efb7-4446-a0e0-0df275fbda15","resolution":{"observed_at":"2026-07-03T21:28:58.291694Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-12T08:53:13.408944Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.01345","last_updated":"2026-07-05T19:53:45Z","snapshot_observed_at":"2026-08-14T10:16:36.384280Z","submitted_at":"2026-07-01T18:03:09Z","title":"TurnNat: Automatic Evaluation of Turn-Taking Naturalness in Dyadic Spoken Dialogue","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-12T08:53:13.408944Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2607.01345"},"observation_digest":"sha256:00a10b5009474369f237273a383d29aae2b8fdf664b781602b0e3807e38f3f8f","observation_id":"f35dd31b-bccb-46ae-a0ce-f1561604963f","resolution":{"observed_at":"2026-07-12T08:53:13.408944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics","version":1},"cited_work":{"arxiv_id":"2503.01174","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.01174","snapshot_observed_at":"2026-07-07T14:53:55.794102Z","title":"Talking turns: Benchmarking audio foundation models on turn-taking dynamics","venue":"cs.CL","work_id":"ceeb072e-0415-4508-999c-bcb728f2e57a","year":2025},"citing_paper":{"arxiv_id":"2607.05365","last_updated":"2026-07-06T17:42:59Z","snapshot_observed_at":"2026-08-13T16:59:23.044763Z","submitted_at":"2026-07-06T17:42:59Z","title":"SPEARBench: A Benchmark for Naturalness Evaluation in Streaming Speech-to-Speech Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-07T14:53:07.512543Z"},"links":{"cited_paper":"/paper/2503.01174","citing_paper":"/paper/2607.05365"},"observation_digest":"sha256:459db0e7164593db4dbc842c260596f06b24e496741c5e35127de6b21ab09bef","observation_id":"2a5d849a-7bfb-46ab-a75d-972749ffa3a9","resolution":{"observed_at":"2026-07-07T14:53:55.795345Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2503.01174/citation-record","integrity":"/paper/2503.01174/integrity","json":"/paper/2503.01174/citation-record.json","paper":"/paper/2503.01174"},"outbound":[],"paper":{"arxiv_id":"2503.01174","last_updated":"2025-03-03T04:46:04Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-20T00:16:26.785032Z","submitted_at":"2025-03-03T04:46:04Z","title":"Talking Turns: Benchmarking Audio Foundation Models on Turn-Taking Dynamics"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2503.01174."}