{"as_of":"2026-08-04T12:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:93d8585a2272bbd4064fb0c746a7f044a5c124903dca0446b5c6c3588c010449","coverage":[{"denominator":138,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T21:18:50.219775Z","state":"measured"},{"denominator":101,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":101,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T20:29:40.071943Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.13841","snapshot_observed_at":"2026-08-01T20:29:40.071943Z","title":"Nguyen, Raghav Mehndiratta, Lindsay Devon Brin, Joseph Marinier, Hari Sub- ramani, Anil Madamala, Sridhar Krishna Nemala, and Srinivas Sunkara","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16610","last_updated":"2026-07-18T03:10:19Z","snapshot_observed_at":"2026-08-03T07:17:28.486666Z","submitted_at":"2026-07-18T03:10:19Z","title":"Just A Rather Very Intelligent Spoken Agent","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T20:29:40.071943Z"},"links":{"cited_paper":"/paper/2605.13841","citing_paper":"/paper/2607.16610"},"observation_digest":"sha256:9b0afefcf8905ba65cb9cce669dd1f13a41c3fa1ec783b15e2e07a87afa3df07","observation_id":"c21312e0-2464-4ab8-b812-bf1c24872a44","resolution":{"observed_at":"2026-08-01T20:29:40.071943Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.13841/citation-record","integrity":"/paper/2605.13841/integrity","json":"/paper/2605.13841/citation-record.json","paper":"/paper/2605.13841"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.04133","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T14:25:47.131356Z","title":"Andres, Vadim Fedorov, Rida Sadek, Enric Spagnolo-Arrizabalaga, and Nadescha Trudel","venue":null,"work_id":"bba6d2c3-5523-446f-8d25-2115671034ac","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:5b99140c1b0fc66868daff62e6100ee2cebc029a4fd62ff37ac2326ca297847f","observation_id":"a2cfb194-a0cc-4da2-aa60-09878467350a","resolution":{"observed_at":"2026-07-01T14:25:47.133222Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.065793Z","title":"SD-Eval: A Benchmark Dataset for Spoken Dialogue Understanding Beyond Words","venue":null,"work_id":"abf9ca4d-7e6b-43ca-9822-dab5306efde2","year":2024},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:9bd5dd56e6718740dbe58789c231c11b98e0f8be2ac9df3b7857b8777ae87f78","observation_id":"03d03786-d910-4335-ac23-cdb289f45760","resolution":{"observed_at":"2026-07-07T17:34:02.066939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.989213Z","title":"Talking Turns: Bench- marking Audio Foundation Models on Turn-Taking Dynamics","venue":null,"work_id":"6d683b29-dca8-4799-913a-3c41424f3813","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:8dde77699c5fe5330bd067c17ad9d74a2eaf8480fd29620a08aa05d3160504cb","observation_id":"581ef5d3-a5ce-4d71-8797-5bb8d36bcfd0","resolution":{"observed_at":"2026-07-07T17:34:01.990445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.03116","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T17:08:43.039081Z","title":"Beyond task completion: Revealing corrupt success in LLM agents through procedure-aware evaluation","venue":null,"work_id":"1827c2b2-960e-4554-825e-b26fb4f8ca26","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:a0fd69f6bd90a6e677153755a05c193b7337df3025742e2d05bb7f89c14a9e67","observation_id":"eb7a3801-1bb6-4651-b273-7211a49bb244","resolution":{"observed_at":"2026-07-01T14:25:47.129768Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1162/tacl.a.628","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:25:04.070551Z","title":"Tan, and Haizhou Li","venue":null,"work_id":"10e4f0a1-ae4c-490b-97f7-1bac3ae8d2c0","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:8cd5185fe82c83578fe8bad84f8eb5d855705450c312c99c0f8ef70e698fc1c1","observation_id":"b2a57ae3-8dd2-4411-a270-ea0da5b88975","resolution":{"observed_at":"2026-06-30T21:25:04.071800Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.acl-long.818","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:25:04.065984Z","title":"VoxEval: Benchmarking the Knowledge Understanding Capabilities of End-to-End Spoken Language Models","venue":null,"work_id":"61ce372b-e1ef-4b81-bec9-fb9ca9cce73d","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:c51264f7f68cbfcc4e3d461aebb88b093aae7de4b04b7d66fb82cbf8b2e5c1b2","observation_id":"a06a26fa-8e95-4554-8c83-acebfb145281","resolution":{"observed_at":"2026-06-30T21:25:04.067689Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.985587Z","title":"Pipecat: Open Source Framework for Voice and Multimodal Conversational AI.https://github.com/ pipecat-ai/pipecat, 2024","venue":null,"work_id":"b7b16a57-4086-4da8-abe6-fc151031e90f","year":2024},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:62fd1d50e3335dbb17d098fd9b43ffd5f3ffe80c75f9ca1683f8880ef6d5d1df","observation_id":"809ba9d9-65f0-4495-a9ca-401f995b1a7b","resolution":{"observed_at":"2026-07-07T17:34:01.986782Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.983881Z","title":"ElevenLabs: Documentation.https://elevenlabs.io/docs/eleven-agents/overview, 2023","venue":null,"work_id":"7e3ce551-77e3-47ad-b501-5be058ca88d9","year":2023},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:75118feb6fa0d72a20cc6423edaa0e95fa5f6dca3b97824d098f69bc553a83ba","observation_id":"22c94290-af3a-43c6-8977-d90ed5cf63ba","resolution":{"observed_at":"2026-07-07T17:34:01.985049Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.987385Z","title":"Gemini Live API: Low-Latency Bidirectional Voice and Video Interactions.https://ai","venue":null,"work_id":"c7a18932-9823-426d-9ab5-0807ea8a42c9","year":2024},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:fbe4df373d6da40ebe7ec0db1e5727ec96bc389e138573788bb947235abe752d","observation_id":"b2a4c394-6887-4731-9f80-0326d9191adc","resolution":{"observed_at":"2026-07-07T17:34:01.988623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.991087Z","title":"Ryan, Aditya Shrivastava, Ali Sartaz Khan, Caleb Ziems, Ella Li, Martijn Bartelds, Michael Sun, Tan Li, Woody Gan, and Diyi Yang","venue":null,"work_id":"396026c7-cc2e-4dbd-9158-e84c963ac17f","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:ae250f5d8552785611649d89ec4e4e53c57638016db22a560cb240df5f27a0f1","observation_id":"cbcdfd28-0195-46d8-a58f-82c6c710155e","resolution":{"observed_at":"2026-07-07T17:34:01.992457Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1121/1.3598457","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:25:04.068430Z","title":"Detection thresholds for gaps, overlaps, and no-gap-no-overlaps.The Journal of the Acoustical Society of America, 130(1):508–513","venue":null,"work_id":"4e09c179-6e9b-400b-9d7f-e4c735ac4d66","year":2011},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:1b0ca56f3d36b24bfbe445715c586efa1551fa6a3f27aa6156a460e471fc4f46","observation_id":"9707c70f-adc3-4527-a630-9011a997aa5d","resolution":{"observed_at":"2026-06-30T21:25:04.069845Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.993058Z","title":"Pauses, gaps and overlaps in conversations.Journal of Phonetics, 38(4):555–568,","venue":null,"work_id":"e2dea385-7173-4ff2-8ab6-5f14268cc916","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:835b7a7daf662f30c908fc148f17070cbfd3d4ea8a1f563d8dd9e7235b583017","observation_id":"d16ff9ba-acc5-4c52-8dec-c745a7846d9c","resolution":{"observed_at":"2026-07-07T17:34:01.994252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.wocn.2010.08.002","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:25:04.062035Z","title":"Pauses, gaps and overlaps in conversations.Journal of Phonetics, 38(4): 555–568","venue":null,"work_id":"e86c0291-1c10-487a-8201-1026ce028228","year":2010},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:603319359b6fea60e4bfc5f9a3eb2744a7064277b77363ac30e5a53a0f8eab05","observation_id":"d6e34fe7-5d00-408a-a1eb-04738d3853b7","resolution":{"observed_at":"2026-06-30T21:25:04.063419Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2022-970","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:25:04.064095Z","title":"The VoiceMOS Challenge 2022","venue":null,"work_id":"693fa6f1-eda4-41ec-9892-e9e32bf9d298","year":2022},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:299a46ea3d0ef469a9da4227825b64e6a360c4527a2cc8aa8a6553c3537c21bd","observation_id":"491f2250-8b47-45ee-a585-e8adb8dcba11","resolution":{"observed_at":"2026-06-30T21:25:04.065312Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-16T18:51:47.9584+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T18:51:47.9584+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.21437/interspeech.2025-1977","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-30T21:25:04.053594Z","title":"SHEET: A Multi-purpose Open-source Speech Human Evaluation Estimation Toolkit","venue":null,"work_id":"e64dad12-3155-4e21-a457-06a5b7824c5b","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:e051092dbcc99d0fb2ede57d10f6557ce931694103fcc9f9d7154a1aa1932e91","observation_id":"10f11399-9227-4f9c-ba4c-ded55c3503d1","resolution":{"observed_at":"2026-06-30T21:25:04.054956Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-16T18:51:47.492947+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-16T18:51:47.492947+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07978","doi":"10.48550/arxiv.2510.07978","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"V oiceagentbench: Are voice assistants ready for agentic tasks?","venue":null,"work_id":"7cea5c75-7751-44f6-9460-92ffa20f5fd8","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:08920a3c58fab81c6fe28c2081538ba5f95433f575dc20b277c8fd8a2bfbd2ea","observation_id":"e0556b6b-e50e-4141-ba14-394a85eaf70d","resolution":{"observed_at":"2026-06-30T21:25:04.058007Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2015.00731","doi":"10.3389/fpsyg.2015.00731","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Levinson and Francisco Torreira","venue":null,"work_id":"672849b2-c802-4715-b09e-095c2d80909a","year":2015},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:11044ed1b64b59ba55521fc95d2721e7791463f48d13c6030b51086578d62f8e","observation_id":"fe572c5a-2a84-4223-9fff-7330b64602d4","resolution":{"observed_at":"2026-06-30T21:25:04.061355Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.07838","last_updated":"2026-04-26T17:52:36Z","snapshot_observed_at":"2026-07-06T22:32:07.945004Z","submitted_at":"2025-10-09T06:30:07Z","title":"Full-Duplex-Bench-v2: A Multi-Turn Evaluation Framework for Duplex Dialogue Systems with an Automated Examiner","version":2},"cited_work":{"arxiv_id":"2510.07838","doi":"10.48550/arxiv.2510.07838","metadata_source":"pith","pith_arxiv_id":"2510.07838","snapshot_observed_at":"2026-07-10T14:17:10.078089Z","title":"Full-Duplex-Bench-v2: A Multi-Turn Evaluation Framework for Duplex Dialogue Systems with an Automated Examiner","venue":"eess.AS","work_id":"3d3db706-1500-4317-80ae-7aa3e12a0c74","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"cited_paper":"/paper/2510.07838","citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:026ed375a6c62edcd7f848c14c21da229fb73a79e6346f164e105a1e0cea98ca","observation_id":"bfb0488b-890b-4548-8443-ad511774b827","resolution":{"observed_at":"2026-07-01T14:25:47.118645Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04721","last_updated":"2025-08-16T05:46:19Z","snapshot_observed_at":"2026-08-02T17:53:21.058380Z","submitted_at":"2025-03-06T18:59:16Z","title":"Full-Duplex-Bench: A Benchmark to Evaluate Full-duplex Spoken Dialogue Models on Turn-taking Capabilities","version":3},"cited_work":{"arxiv_id":"2503.04721","doi":"10.48550/arxiv.2503.04721","metadata_source":"pith","pith_arxiv_id":"2503.04721","snapshot_observed_at":"2026-07-10T14:17:10.075156Z","title":"In2024 IEEE Spo- ken Language Technology Workshop (SLT), pages 1115–1122","venue":"cs.CL","work_id":"8553d8cf-0da9-40b7-a402-7c170c79df4b","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"cited_paper":"/paper/2503.04721","citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:4337234f1dfff650209ed15682b283d6c2764a42cf103fad1b99d76fe8ab83ca","observation_id":"d7fcef41-b114-4c76-9f6b-2a7add5d7f53","resolution":{"observed_at":"2026-07-01T14:25:47.121399Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-10T18:18:51.434968+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T18:18:51.434968+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.04847","last_updated":"2026-04-06T16:46:52Z","snapshot_observed_at":"2026-07-30T13:35:58.385594Z","submitted_at":"2026-04-06T16:46:52Z","title":"Full-Duplex-Bench-v3: Benchmarking Tool Use for Full-Duplex Voice Agents Under Real-World Disfluency","version":1},"cited_work":{"arxiv_id":"2604.04847","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.04847","snapshot_observed_at":"2026-07-03T05:07:39.484923Z","title":"Full-Duplex-Bench-v3: Benchmarking Tool Use for Full-Duplex Voice Agents Under Real-World Disfluency","venue":"eess.AS","work_id":"6da1c3ad-7efd-4725-94ab-5c349a14c6c8","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"cited_paper":"/paper/2604.04847","citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:e1be268e818c558dbed01a8219c3cf3c659570cc69745bad2a5ff0a44af5e1d0","observation_id":"e4557bc7-9175-4079-b667-429079e97ca9","resolution":{"observed_at":"2026-07-01T14:25:47.115729Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.970390Z","title":"Full-Duplex-Bench v1.5: Evaluating Overlap Handling for Full-Duplex Speech Models","venue":null,"work_id":"d3050eec-f776-43d0-b6b0-6a033d1edf89","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:0bc6c2f4a08966b82ed0f85dba6cbc0cc694d409693710635811c468b5fff099","observation_id":"26555263-6b7f-4189-932e-0806e63cdde5","resolution":{"observed_at":"2026-07-07T17:34:01.971615Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.23159","last_updated":"2026-04-26T17:51:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-30T23:41:05Z","title":"Full-Duplex-Bench v1.5: Evaluating Overlap Handling for Full-Duplex Speech Models","version":4},"cited_work":{"arxiv_id":"2507.23159","doi":"10.48550/arxiv.2507.23159","metadata_source":"pith","pith_arxiv_id":"2507.23159","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Full-Duplex-Bench v1.5: Evaluating Overlap Handling for Full-Duplex Speech Models","venue":"eess.AS","work_id":"5f7ec4c8-48c0-4996-b251-8e1e32341544","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"cited_paper":"/paper/2507.23159","citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:8228311d6ebf552231656902446fc82299781eb76dde4436360782c6b8d01531","observation_id":"117ab259-f049-4ba1-8bed-7a99102540d8","resolution":{"observed_at":"2026-06-30T21:25:04.053400Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.966132Z","title":"EmergentTTS-Eval: Evaluating TTS Models on Complex Prosodic, Expressiveness, and Linguistic Challenges Using Model-as-a-Judge","venue":null,"work_id":"b2a8d854-5e71-4200-a6ab-ac6dd6cd0767","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:2c6dffac1073f71be28d211b4247d5de1ecf0c72357705fec647ab111926fcec","observation_id":"3e1f7f65-a0df-437a-9672-4964370d6835","resolution":{"observed_at":"2026-07-07T17:34:01.967600Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.14136","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T16:58:43.790594Z","title":"Beyond accuracy: A multi-dimensional framework for evaluating enterprise agentic AI systems","venue":null,"work_id":"5faa1e62-6362-45c3-8b1e-0fff76b7ff6d","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:8f6f27f0ac85b45e35648c0c9ce5b280a6ec8738b1577fe64e4c99a0ee0bc081","observation_id":"1189f227-ea8b-4498-97f3-03f8342515c4","resolution":{"observed_at":"2026-07-01T14:25:47.126961Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.972193Z","title":"AI Voice Agents: 2025 Update","venue":null,"work_id":"730b657b-0ac9-4662-bd41-840f7659d9c5","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:be63f8d78b808d16f72e69e1485624e37cedb32fa7d20c65008a3cc56a851c0a","observation_id":"b7c25d48-64b9-4f05-bcd0-81dd4a8f4b64","resolution":{"observed_at":"2026-07-07T17:34:01.973481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.982154Z","title":"Realtime API Documentation.https://platform.openai.com/docs/guides/realtime, 2024","venue":null,"work_id":"a4101a55-2a61-4ad2-83c4-d2bcbe447478","year":2024},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:9ac3d930e7b2054e46c9013ca0e6f601b939814c84eeb3dbecd1136dbe75061a","observation_id":"e0eb8470-1497-4960-a5d5-e1f57585d4ef","resolution":{"observed_at":"2026-07-07T17:34:01.983293Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.994853Z","title":"Patil, Huanzhi Mao, Fanjia Yan, Charlie Cheng-Jie Ji, Vishnu Suresh, Ion Stoica, and Joseph E","venue":null,"work_id":"8f4b8384-7ed2-4347-b1ed-a6bd46d91df7","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:e6a62723a9a1e60132e5fbd04d5e60c386383e3548a5556cc71cc5b044c23946","observation_id":"9084ffe0-f99a-4b1f-bc45-d7df29eb4869","resolution":{"observed_at":"2026-07-07T17:34:01.996000Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.031550Z","title":"FD-Bench: A Full-Duplex Benchmarking Pipeline Designed for Full Duplex Spoken Dialogue Systems","venue":null,"work_id":"9966f041-770c-4059-bb4f-9ae33505e43e","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:fdbb39a91dc007921747dfe4920ed0900df141a049873555c4036680e5b434e1","observation_id":"31d1975c-13f9-432f-b245-0a897bbaf9c2","resolution":{"observed_at":"2026-07-07T17:34:02.032919Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.15432","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T03:49:29.829575Z","title":"Sygra: A unified graph-based framework for scalable generation, quality tagging, and management of synthetic data","venue":null,"work_id":"91e46640-15b9-4931-a2de-8b9263c0d8a5","year":2025},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:b4ef1f24703c8d5ad59fae989ec2ceff6457f36bc31c39df598d48fa0508575f","observation_id":"dfee84a9-e90a-4229-aae6-adb2b55b47dc","resolution":{"observed_at":"2026-07-01T14:25:47.104404Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.952346Z","title":"ToolLLM: Facilitating large language models to master 16000+ real-world APIs","venue":null,"work_id":"0ed9f30e-efab-4bf1-b358-dfe611c65854","year":2024},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:020102702330db714ee33d0b1a1a7d269b381d9ea0116d129a5409a1eb22e19c","observation_id":"b09a3a31-4740-42f3-9118-290e166eae78","resolution":{"observed_at":"2026-07-07T17:34:01.953554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.13686","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T14:53:55.776778Z","title":"τ-voice: Benchmarking full-duplex voice agents on real-world domains","venue":null,"work_id":"c4040e48-4bc5-465c-9fea-df887e8f4fdd","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:264afd37620c4d52a60289544ba0e13282469f119e3cbdd363b56507e342638b","observation_id":"9d53fad7-ec73-405a-bab2-6e552523f907","resolution":{"observed_at":"2026-07-01T14:25:47.112787Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2011.558002","doi":"10.1080/0163853x.2011.558002","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Judgments concerning the valence of inter-turn silence across speakers of American English, Italian, and Japanese.Discourse Processes, 48(5):331–354","venue":null,"work_id":"ff069990-422c-4134-a282-eefaf53ea775","year":2011},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:b5bc7a46872fb0a408cf58402cb170cd26cfdd6f1f7a29a2c1bd84ef455ce1cf","observation_id":"ae66b040-d302-4240-9677-bd86a47035c3","resolution":{"observed_at":"2026-06-30T21:25:04.065368Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.03674","last_updated":"2020-10-07T22:15:34Z","snapshot_observed_at":"2026-07-06T10:02:30.383493Z","submitted_at":"2020-10-07T22:15:34Z","title":"Designing Sequence with Minimum PSL Using Chebyshev Distance and its Application for Chaotic MIMO Radar Waveform Design","version":1},"cited_work":{"arxiv_id":"2010.03674","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2010.03674","snapshot_observed_at":"2026-07-01T14:25:47.122621Z","title":"Turn-taking in conversational systems and human-robot interaction: A review.Computer Speech & Language, 67:101178","venue":null,"work_id":"565e8695-53fd-4318-9bd6-b4f6c3fdee8a","year":2021},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"cited_paper":"/paper/2010.03674","citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:b85ee22c80442bea1122e5076295f69613c46ff9d1fb3afca26dce32ff9d4cd6","observation_id":"86324a3b-4de2-4de7-8700-41622d0cae38","resolution":{"observed_at":"2026-07-01T14:25:47.124244Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.863724Z","title":"Universals and cultural variation in turn-taking in conversation.Proceedings of the National Academy of Sciences, 106(26):10587–10592","venue":null,"work_id":"6ecfefea-27f1-4b94-b561-7e1ed67664b4","year":2009},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:d7afe64d5116d155ef52e759313ee3605477b7b5080631983d0ea7efa43cfae7","observation_id":"498c7580-a608-4b40-bd33-9d774ab35e6a","resolution":{"observed_at":"2026-07-07T17:34:01.864966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.893139Z","title":"SUPERB: Speech Processing Universal PERformance Benchmark","venue":null,"work_id":"2a804d84-f7a7-4114-93cc-c92192a7670e","year":2021},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:99f92356244796ca9ce9ed050dd7e9ce325f5039d36e6a3e3a1eb86c48548884","observation_id":"9ff28cd6-875d-41c5-86b0-93686e9ed13f","resolution":{"observed_at":"2026-07-07T17:34:01.894694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.891042Z","title":"InThe Thirteenth International Conference on Learning Representations,","venue":null,"work_id":"336c604d-67f7-44ab-ad80-30a74fd25f29","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:ba704f11af103570b3bbd1680f3a856d91468bd44999e5545e59841a418cfa7a","observation_id":"df8ab3db-86b7-4941-b6a3-63ab4bea0522","resolution":{"observed_at":"2026-07-07T17:34:01.892547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.968171Z","title":null,"venue":null,"work_id":"105c33b9-c1f0-4730-9d01-8ecb17ad517a","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:9025faf682343f9938d641642ca9a0a011dde0964cffcfc8b1f0c7633e585b62","observation_id":"f1c803c5-71af-4858-85d0-d490ab135efd","resolution":{"observed_at":"2026-07-07T17:34:01.969760Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.957454Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":"a726ba40-5d33-40f5-aaed-0366ccb07546","year":2023},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:8d6d54a3faef1ffe855c1bf585066d53add5e82dee1696f0dc43b781d758142a","observation_id":"5bfbbd83-39fd-4495-be74-d384639c8cb3","resolution":{"observed_at":"2026-07-07T17:34:01.958508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.11245","last_updated":"2026-07-31T22:23:28Z","snapshot_observed_at":"2026-08-04T12:12:34.973283Z","submitted_at":"2026-03-11T19:12:31Z","title":"Mind the Sim2Real Gap in User Simulation for Agentic Tasks","version":2},"cited_work":{"arxiv_id":"2603.11245","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2603.11245","snapshot_observed_at":"2026-08-04T01:49:27.862601Z","title":"Mind the sim2real gap in user simulation for agentic tasks, 2026 b","venue":null,"work_id":"a8c0ed0b-a80e-4e3f-9e2f-a9d0dbd9f108","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"cited_paper":"/paper/2603.11245","citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:f3773628d7697a19f54d9a0955b0499729e8ad8361ddf70a19312016678ecafa","observation_id":"eec8afde-2cc6-490f-b1f0-4ebd474ea22b","resolution":{"observed_at":"2026-08-04T01:49:27.862601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.885608Z","title":null,"venue":null,"work_id":"befb7439-58e7-47da-b805-10b532a429c4","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:679a46a705c971fcca7023be4412ac37f09f8a56c3483899fa3a60716e2e09e0","observation_id":"f03d06af-fb76-4077-8023-5c91d37c444e","resolution":{"observed_at":"2026-07-07T17:34:01.886677Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.007277Z","title":null,"venue":null,"work_id":"ba18292e-f092-4b55-9e8a-dda96957b9c2","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:9b6b1ec741f9470f927a49ddb3de28d75124e0dcba480b88bcceaff14edef685","observation_id":"db7081b4-f6ea-44ad-adad-b7ad06aa27a5","resolution":{"observed_at":"2026-07-07T17:34:02.008366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.947201Z","title":null,"venue":null,"work_id":"bbaaa736-55ec-47f1-8603-a1bb65d3ef8e","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:b4286d7a6a53a640ef6912e6305c21e39e7c9d385d910d2807216a1bf5a076c0","observation_id":"5f77dd89-a853-4e08-a786-bad1b3a1c6a4","resolution":{"observed_at":"2026-07-07T17:34:01.948187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.878570Z","title":"End Conversation","venue":null,"work_id":"5051e95c-cf7b-4126-9c14-15f82251b76d","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:93d8a1460a51442481b02e197a2a4dff5ff6093c2c97919bb6fe05b8927d11e5","observation_id":"2b805154-5823-4424-93e3-ead49efa04cf","resolution":{"observed_at":"2026-07-07T17:34:01.879633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.881810Z","title":null,"venue":null,"work_id":"88d90b5d-79a9-48cf-bc6e-bf548eb4eb97","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:7638ed2c74926aa95c3cc4137c223c5915bb138b87610017077370f66d10d051","observation_id":"84964120-6a0c-4cf3-880c-d27fafa17a92","resolution":{"observed_at":"2026-07-07T17:34:01.883089Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.945692Z","title":null,"venue":null,"work_id":"212838ca-629d-40a6-9a05-328bbfadfd83","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:cc09c66ef577e6368675ec1f3a41d539cd82c5997fab77b233695b80ea6e8a7a","observation_id":"697f3e85-671f-40a4-9405-44246c91e786","resolution":{"observed_at":"2026-07-07T17:34:01.946699Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.877031Z","title":null,"venue":null,"work_id":"b90e89f4-bdf7-445d-a98e-899260ee9390","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:58f619884efa822215f31cb560e6512e566087c5731ab684cb0ea4fd28a7783b","observation_id":"f52c5414-98d6-4446-8b90-70f99913f992","resolution":{"observed_at":"2026-07-07T17:34:01.877994Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.860463Z","title":null,"venue":null,"work_id":"55a1dcae-2071-463c-9e93-ba10fb990ad5","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:52c1e3d01abbd66a0c14bf235400781fb577da52169d431c577316076d6cccb4","observation_id":"b9a8eb70-0f4a-404a-89f8-eb62f900c177","resolution":{"observed_at":"2026-07-07T17:34:01.861527Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.959079Z","title":null,"venue":null,"work_id":"965e147d-4e0f-4c3c-9042-74b009392ee8","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:ca3b2d6226149a15d886fcb2af02a386aa16319d9bbbe7883d72d7c765789e0a","observation_id":"5b0df52e-e5f9-4245-abbb-c746ade3e43c","resolution":{"observed_at":"2026-07-07T17:34:01.960148Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.897490Z","title":"I’m sorry I encountered an error processing your request","venue":null,"work_id":"fe140560-8bce-4acc-8ac0-6ee66aecb9e2","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:6de0927d94a6696e1bda4a80e30068b5fe31f6a7e17cbddf103e4732de35abb5","observation_id":"91068d12-57a6-4c74-b07b-f24d9d2d0180","resolution":{"observed_at":"2026-07-07T17:34:01.898888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.931410Z","title":"The user simulator prompt explicitly instructs the user to decline any such offers from the agent, but we check for violations regardless","venue":null,"work_id":"9c195c0c-5fcf-4834-a928-a4e8e4049d0a","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:4a6ddf23af64078442e7440d684b4a99086eb47225f30397ae7f5b59fce9c02c","observation_id":"46e07d9d-17eb-4db1-9c75-63344fc978ee","resolution":{"observed_at":"2026-07-07T17:34:01.932668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.055542Z","title":"If the user hangs up prematurely—for example, providing actionable information and ending the call in the same turn—the agent has no opportunity to execute the required tool calls","venue":null,"work_id":"6961584e-e8a5-4f5f-a755-e8b2df4ed86e","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:c25cf3baa1dc4273ce2744c8efba2a963e0a7901bbc438ddb8b82de8e6638d3f","observation_id":"19f53020-cd7b-4362-850b-f600fd2ae8e0","resolution":{"observed_at":"2026-07-07T17:34:02.056803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.934736Z","title":null,"venue":null,"work_id":"8d92338c-6bba-4c1e-80f0-9498c2a021dd","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:78a7a89ba8c99a2989725ef7a64a1ca7e5b442f02ada12f1c5c4f02106b764f3","observation_id":"ab68d46e-0618-4d6a-8796-4ced5eadb6f7","resolution":{"observed_at":"2026-07-07T17:34:01.935724Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.960690Z","title":"The agent then acts on the duplicate request, causing redundant writes to the scenario database that cause the final state comparison to fail","venue":null,"work_id":"6fd4ee4d-d4c4-42a6-9300-8ff9c68585ae","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:218eda01e8ef6f5853d8ea9c1c88e51988a2b2c3491f4c177107dd92873e929a","observation_id":"ec7507df-a895-479c-b971-319be9034557","resolution":{"observed_at":"2026-07-07T17:34:01.961894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.867439Z","title":"accept the earlier flight if the price difference is under $200, otherwise decline","venue":null,"work_id":"c9a9c2bd-5563-4589-acc5-aa8436d9db14","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:a76f87860fbe2ae4ca9acd0164b91799e751971452665547ece8303e8915f8ee","observation_id":"d6e74578-926a-4059-b5e4-34c7ffe4a169","resolution":{"observed_at":"2026-07-07T17:34:01.868575Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.869125Z","title":null,"venue":null,"work_id":"a2edbbec-3168-4d9d-8286-28fe30d59404","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:c50021c596a8c2ca59e4e6afe874030a8f1470607e1ce1ed7a8ddad8e4d2ff43","observation_id":"78b94a0f-a544-4323-902c-3332fd3199fe","resolution":{"observed_at":"2026-07-07T17:34:01.870149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.873876Z","title":null,"venue":null,"work_id":"626a757f-392e-432f-99cc-b52fbf1e6762","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:081cb4ea637621b097fd7e3a1bc494403c4fe4c09749c9136cc2c6f1f9e797b7","observation_id":"55e9563f-920b-464e-949c-c0fd0df75849","resolution":{"observed_at":"2026-07-07T17:34:01.874867Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.870727Z","title":"stay open","venue":null,"work_id":"0a6aa61a-d2dd-4092-b6ab-6aaf8e39cc85","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:b630d712e3e1fbefb2901e23a9a43a1e5d38f61c94ec7f9955b8496635f3efbc","observation_id":"f4ea31af-fe61-44ab-bd93-6c8436ae430f","resolution":{"observed_at":"2026-07-07T17:34:01.871774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.872304Z","title":null,"venue":null,"work_id":"e50c1759-df2c-4624-a850-ef3d065473ae","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:76823edf11816d3cc2b16160110b772d552816c13c0226449552400f95a48c38","observation_id":"9d914afc-1c43-48eb-976c-d4aa1f0c1aab","resolution":{"observed_at":"2026-07-07T17:34:01.873325Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.976116Z","title":"[Assistant speaks]","venue":null,"work_id":"d7c8f03d-2c7f-45ad-b9cd-886f83087c02","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:e2400cb3a7bb9b13ca499a2db67e4e9eb7807d881aaf4507741216dbd4c630d2","observation_id":"ceb36fa6-23ed-4235-94be-c34690ed9606","resolution":{"observed_at":"2026-07-07T17:34:01.977225Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.998579Z","title":null,"venue":null,"work_id":"d32b9dd2-b6c0-4e2b-ab10-f1495f1b55ee","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:35ef19511e9e7e5700b14b20b209e5301fbaf168983111b27f65cc36571c3c20","observation_id":"27ed85dc-064f-4d9a-91a3-e90f00d67bcb","resolution":{"observed_at":"2026-07-07T17:34:01.999740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.059254Z","title":null,"venue":null,"work_id":"ce9c8df0-902d-4026-8ca9-18aed41a4c81","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:5b727533b319a9746f2095d7ccd7994154e91101889ffc79d543ade899a35a1a","observation_id":"a2eed5c9-790b-4909-8180-7affe9eee0aa","resolution":{"observed_at":"2026-07-07T17:34:02.060261Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.019071Z","title":null,"venue":null,"work_id":"3fa7ecf7-8119-4d7d-9ea5-957b5ceb8946","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:1290d704809be9289e4f2c52c96a2c0e2db2ef632eaa4b8994a7aa2c2ef48f56","observation_id":"6ac7dc30-7126-4b62-a1a8-ab675902d016","resolution":{"observed_at":"2026-07-07T17:34:02.020185Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.880170Z","title":null,"venue":null,"work_id":"cd49b475-9ab8-4cea-90de-1883886e5389","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:87fcd418b35b9d04a2846f9c11472f95cde9425a26a3b376d3ec26ee3a9e589a","observation_id":"c9c4e849-1dc8-45da-9987-304bb1ef71e5","resolution":{"observed_at":"2026-07-07T17:34:01.881230Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.948770Z","title":"What will the change fee be in total?","venue":null,"work_id":"977c7ab1-468b-4adf-8108-15c1290a80cb","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:8f1c3809cee2662c2e04b1f67745e9ce961b19bbf19c0566aedfa256b0df7ac7","observation_id":"0e03a2de-30d9-487b-ad28-6baad5f75e3f","resolution":{"observed_at":"2026-07-07T17:34:01.949921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.000345Z","title":"It needs to be today, direct LAX to SFO, leaving before 2PM, and the fee has to be under $80—can you check again?","venue":null,"work_id":"619bc669-7d64-4d7f-b3f7-5d3f9f9b1b7f","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:9ac7befceae9c863e37594d7c9405764cbaf4ae67312406ec2e63f6c3b654b3a","observation_id":"fcf5c15d-2967-41c4-af81-f0311789b0d5","resolution":{"observed_at":"2026-07-07T17:34:02.001486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.003892Z","title":null,"venue":null,"work_id":"b90fc954-453e-432e-a6a1-1f2696396422","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:b294b51aa0b5e94fce2701af29a3d1b975e3ebbaae090bd3d3a1a7a715b76173","observation_id":"cb0371bf-9742-45d0-ad07-c3dd05265afe","resolution":{"observed_at":"2026-07-07T17:34:02.004924Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.996965Z","title":null,"venue":null,"work_id":"38a9fb14-f2e8-42b4-ba96-6d31dce414f3","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:f3976781f149faa010175a9ad6afed9853c7011f44a72a7e785ae79f3b904776","observation_id":"89e0ce2a-7295-4666-9e1c-7585c4738185","resolution":{"observed_at":"2026-07-07T17:34:01.998017Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.005422Z","title":null,"venue":null,"work_id":"0283dbbb-e26b-4d2a-b683-b48ba76fd580","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:12c5d0422fd892e99bd89fd6bc12504515599188b4743f7c5296706a1d1bb552","observation_id":"b238c19e-37fd-45aa-a9fc-353a7ebc6255","resolution":{"observed_at":"2026-07-07T17:34:02.006473Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.955801Z","title":"V O R J U","venue":null,"work_id":"64f9c7d2-7627-4e1d-a53f-5b1f898f3ccf","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:e461791bde5e015687649f76240d33edcff1bae22f92918132b262383b14332a","observation_id":"6ea20e51-9266-4d52-837f-8003c30886a4","resolution":{"observed_at":"2026-07-07T17:34:01.956856Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.974087Z","title":"(fare $228 in main cabin)","venue":null,"work_id":"c5216713-9679-418d-9129-498535b12fdd","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:b060052315181a5065b68a2be2a282a7a01f4c2aeb965fc66904a93068a3945d","observation_id":"a0674b7d-01fc-40b0-9fe0-37f834266c51","resolution":{"observed_at":"2026-07-07T17:34:01.975216Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.978269Z","title":"LAX”, destination: “SFO","venue":null,"work_id":"ecddcce5-d53b-438b-8eca-c86cbd81b60d","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:a3abc86b11eca250c1373b35d5f0849103a559ee5a69a2f3c74148f94dab8a09","observation_id":"2df88a94-5cf5-43d5-894d-aff186d699e4","resolution":{"observed_at":"2026-07-07T17:34:01.979514Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.903058Z","title":"Provide your employee ID and the last four digits of your phone number","venue":null,"work_id":"8a90a498-773f-4522-aa20-ec8f0a67fe23","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:58a7c68acaa9d88eed90384ee4fc179794c43a529f2b2c9aef5b2c89eb90b51c","observation_id":"3ca94cc8-8bf1-45c3-b7c3-4afca7bf17b5","resolution":{"observed_at":"2026-07-07T17:34:01.904304Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.062413Z","title":"Do not add details for any item until the agent asks about that specific item","venue":null,"work_id":"c02f2b5a-3e20-4d2c-9c87-f68fba01b73b","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:4b1ca5a23364bea128f8d22cbde9cfd5541695043dcbf2cc7fdf5249ed245cbf","observation_id":"7dfcdb2c-b190-4e66-a3e1-5a532b6d6eca","resolution":{"observed_at":"2026-07-07T17:34:02.063595Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.939872Z","title":"If asked which service, say email","venue":null,"work_id":"24bd41b2-860c-4260-bde5-e4ebe8ad25d7","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:3a1a56355842f8fc381cbc06b31987ccf0d87e8d72f085b7c19c0ab44abdec2e","observation_id":"b6e7de40-6024-450b-80e4-ac38bc7542ec","resolution":{"observed_at":"2026-07-07T17:34:01.941593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.895324Z","title":"What happens next?","venue":null,"work_id":"d54d0111-fbdb-43a9-a907-c5b234548d6a","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:2e8ad919e94ead01b80ba598e38a264298bb992fcc4395783cabe39b913a53dc","observation_id":"8f5f588f-05c5-47e6-94b9-0fbd266174fe","resolution":{"observed_at":"2026-07-07T17:34:01.896875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.883679Z","title":"If asked for access level, choose read_only","venue":null,"work_id":"5b148456-edf9-48f9-a0e7-0d21fecd59c5","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:a4fe41fd7d34de4023ac90416bb59c1cc3d5891e719261102e34d6dd02cfba16","observation_id":"1e9a7529-26e1-4f77-a7f7-2a3b40769c8c","resolution":{"observed_at":"2026-07-07T17:34:01.885066Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.858622Z","title":"If asked whether you want permanent or temporary, choose temporary","venue":null,"work_id":"f8e7644c-31bb-47e3-9144-55af4f39d975","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:800c417b7e3c99a608b9ae1a9bacd9d310123bdc4ae2207d44b3975d48359130","observation_id":"289fefa7-0fa7-4f35-a50e-91d9f8a911f1","resolution":{"observed_at":"2026-07-07T17:34:01.859849Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.053999Z","title":null,"venue":null,"work_id":"9415dbe4-ae60-4f12-9190-d96efc7b6d2e","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:63a9c3d4e2c16d9e789295094ad1328fabaea1a50d07bcf9eceb1e9f173dfd08","observation_id":"0fe2adac-0ede-4960-88b1-7fcc943c9b77","resolution":{"observed_at":"2026-07-07T17:34:02.054984Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.001988Z","title":"Do not invent missing details","venue":null,"work_id":"c43ebdc7-fbf5-410d-8c09-1b09c46e782a","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:7088edd370bce777088476f1d51cfd636500563428430a9e3667a29873942116","observation_id":"63819514-65bf-4092-a6a9-584043f0e57d","resolution":{"observed_at":"2026-07-07T17:34:02.002998Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.041804Z","title":"If it does not match, correct only the incorrect field and nothing else","venue":null,"work_id":"76ed93e6-803d-4a49-92b0-f72c97c1a51d","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:d01402d5a796d7359962432afdbe8f6645863a55e6ef0c404ad55abaa9c01ee2","observation_id":"eaaec476-1bc0-42a4-92b5-5f237b5d0e50","resolution":{"observed_at":"2026-07-07T17:34:02.042963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.064135Z","title":null,"venue":null,"work_id":"0e4a57c1-2c34-4d32-846d-7667d5ce198f","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:232195d4c9ab5ff89925977c1a4f1cf6c31ba3b669430937dba181c903868809","observation_id":"c9651826-13da-4913-a644-e2da26dfbed1","resolution":{"observed_at":"2026-07-07T17:34:02.065206Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.035178Z","title":null,"venue":null,"work_id":"00eaf642-0652-4268-933a-ab685547edcc","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:89850ed667ed5f25f62455c00c1b394c2f1b57b95b2c847288ef1c2b01c4c262","observation_id":"76784c99-4655-4919-84d9-eceb1af53656","resolution":{"observed_at":"2026-07-07T17:34:02.036244Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.022474Z","title":null,"venue":null,"work_id":"b71f0a64-6ab4-4a10-a4c9-0788771a7aac","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:1c3b1705dba97ce434f9eeb7821c9f5c65169081b72af4fc9a5b2a6596f36902","observation_id":"c33eee9b-8027-4cbb-af8c-bb7fd6dae12d","resolution":{"observed_at":"2026-07-07T17:34:02.023698Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.026132Z","title":null,"venue":null,"work_id":"aeb53407-e021-43fa-9e27-31af70943316","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:56a4a85329a816cade92e01c2444c9a970c7acc21e467cfb3a0c435f18b4c02b","observation_id":"49b660b4-82d2-4740-8f3b-92681e2deddd","resolution":{"observed_at":"2026-07-07T17:34:02.027384Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.033513Z","title":"EMP093274","venue":null,"work_id":"58a60963-11bd-421b-8966-e7dbec24ea89","year":2026},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:7303a3d7003bcdfe6a21a8b0d729560580e4f8497f3fb796fd6bdf6199f1c896","observation_id":"af54eb8c-5726-43db-98fc-dae99326151a","resolution":{"observed_at":"2026-07-07T17:34:02.034594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.012208Z","title":null,"venue":null,"work_id":"3f94864d-1136-48fc-9371-50362af1d90a","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:4809951279acd83300b00afd15db822f631271fc0ce781928de36a77f6e141ac","observation_id":"ea23b33e-de18-48fd-9487-9d598bdc068c","resolution":{"observed_at":"2026-07-07T17:34:02.013255Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.015490Z","title":"If OTP is initiated, confirm the last four digits of the phone number only if they match, then provide the OTP code exactly as listed","venue":null,"work_id":"6fe5d983-63ab-4073-88cf-f5a25d98f95d","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:0e782dcb66c088cfd3117c5a10decf0170a47ce2e7ca502445637885e209a5c8","observation_id":"55e4d42e-7555-4ffe-896f-0dd6086fcc15","resolution":{"observed_at":"2026-07-07T17:34:02.016727Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.017338Z","title":"Do not offer an alternate future start date on your own","venue":null,"work_id":"1adb44b7-ab15-4449-a0f8-0e0b8f5d2c28","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:aff6379ca4eff98bdaed794045c0689c00864088b5a114469515938dfc4e3f0b","observation_id":"9c5f5c7b-1492-45d4-9a7d-e7f591cc42fe","resolution":{"observed_at":"2026-07-07T17:34:02.018511Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.036817Z","title":null,"venue":null,"work_id":"854643e7-6e8e-43a5-a158-3d97fdb32d0e","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:68ffc745a0284a4359224bab30142b189d9dd3caebdfc6ec65dccf25c2cc566a","observation_id":"6b26533f-d8c7-4444-81d4-d41b36be8b31","resolution":{"observed_at":"2026-07-07T17:34:02.037855Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.046977Z","title":null,"venue":null,"work_id":"6dfd93b6-b36b-4179-82ce-ddc39a6fe8ba","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:482c1296c0a6c9d3f01a162a54838d49e974d22972e86513dce8c3e8e34aa59a","observation_id":"44524d07-16fb-4c3d-a3f5-bb507c58f8b6","resolution":{"observed_at":"2026-07-07T17:34:02.048007Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.964264Z","title":null,"venue":null,"work_id":"550d2145-b9cf-41c9-a7ba-cc7c53a2ee16","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:2497a13e558e6c2a20b4e264f2ce852a2e0e8b06277fc6b9aa0c57f3fbabf364","observation_id":"66fd48ab-6cf1-4ac1-941c-490447af62f6","resolution":{"observed_at":"2026-07-07T17:34:01.965340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.980193Z","title":"If the agent offers to help with a new start date that is today or in the future, do not switch to that new request; simply acknowledge the policy and wrap up","venue":null,"work_id":"931edc89-101b-4d5b-9104-500583c943cc","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:41b893224c235d0a67f64a2b47cc05025b87cbd0643c6f5a1e8be07afef65fe5","observation_id":"af15eec8-dd7a-4d7e-a54d-bcba3e21d20b","resolution":{"observed_at":"2026-07-07T17:34:01.981550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.010607Z","title":null,"venue":null,"work_id":"e1510f0a-a898-4855-91b8-fbea9a917785","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:2afaa552633471dcab1cc57bb97abd343e7ae11df39fb5db65f27be1ff5afc9c","observation_id":"86f523b1-e46e-41ec-b375-11549e6910e1","resolution":{"observed_at":"2026-07-07T17:34:02.011646Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.865514Z","title":"If the question asks for something not defined there, say you do not have any additional information","venue":null,"work_id":"39e49e85-67ed-41cf-b732-cc09a7829f1c","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:2ceafb62544eec3e156c0fe4edae992b30cb4c2f8aaa5bffcd6ae4cece98bcab","observation_id":"51dc5d1d-8886-4da4-ac90-999e4dec5190","resolution":{"observed_at":"2026-07-07T17:34:01.866857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.924462Z","title":"Resolution Condition.You have received a clear explanation that FMLA cannot be filed with the requested backdated start date and that no case will be opened for that request","venue":null,"work_id":"93118322-5420-4815-98dd-60d8cc503d4c","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:0b5fd80dd214c7df58f55fa5b67a578aa5815e1062a1e6189928c7e438876578","observation_id":"07e2a144-3205-43b8-ba52-75675cc6a5d0","resolution":{"observed_at":"2026-07-07T17:34:01.925812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.942182Z","title":null,"venue":null,"work_id":"b7b0a15e-32d0-4486-9c2f-bdd9a94e4af2","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:5444f8b4f5722b4f1ddd000f8a53e7fa33a87f54cd8cc1234246b40ca0b48774","observation_id":"f2029016-1c7c-4348-b375-3695cf2ef150","resolution":{"observed_at":"2026-07-07T17:34:01.943251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:02.045337Z","title":null,"venue":null,"work_id":"5745ebf9-0af3-487f-9842-568eee3dbaae","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":102,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:f1833a191612a757e8fa830c568d912f83b364ba623f5f5559cad99d08da5d96","observation_id":"603fa17e-fc3c-4ed4-881c-b91b0c87547d","resolution":{"observed_at":"2026-07-07T17:34:02.046391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.929751Z","title":null,"venue":null,"work_id":"d6fa8ea8-438a-4f50-9980-0616401131a2","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":103,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:d89a625982dddac4fe6d3f439f4a33fbc61bdf112691e3d88f34085435b2507b","observation_id":"f9f08c0e-840d-439c-b56f-fc9bb0557043","resolution":{"observed_at":"2026-07-07T17:34:01.930848Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.922890Z","title":null,"venue":null,"work_id":"c091efae-4767-4feb-a807-7f43d1be1f75","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":104,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:d0d48da1f69533b31dcef85b725b73f0056f10d475f7e31bf46f5aafba83b655","observation_id":"7e57a5af-881d-4f9b-b486-340f770290fd","resolution":{"observed_at":"2026-07-07T17:34:01.923910Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T17:34:01.926444Z","title":null,"venue":null,"work_id":"b83d8d5e-e811-4ebd-bcb3-5d0a918bd942","year":null},"citing_paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents","version":2},"reference_index":105,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:50.219775Z"},"links":{"citing_paper":"/paper/2605.13841"},"observation_digest":"sha256:d5b7122695458617d85bead7159ac9d7349a8bed55c60a39c7efcd8338900bc2","observation_id":"18ba3a09-f417-4fe3-8d9a-12ebf86a5d45","resolution":{"observed_at":"2026-07-07T17:34:01.927534Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.13841","last_updated":"2026-05-27T20:23:25Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-03T16:44:41.495234Z","submitted_at":"2026-05-13T17:58:52Z","title":"EVA-Bench: A New End-to-end Framework for Evaluating Voice Agents"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":35,"verified_exact":17,"verified_fuzzy":44},"total_outbound_references":138},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 100 of 138 outbound references and 1 inbound Pith citation observation for arXiv:2605.13841."}