{"as_of":"2026-08-08T20:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a0826c64483193e1162e55ce5455b89e13844f759acbb509b99cc10f89e46c89","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T01:00:26.218590Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12266/citation-record","integrity":"/paper/2506.12266/integrity","json":"/paper/2506.12266/citation-record.json","paper":"/paper/2506.12266"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:28.358802Z","title":null,"venue":null,"work_id":"6aae239f-85ca-4437-9c36-00d2c6740dfa","year":2020},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.372714Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:5bdb413db5bf48877058a956307a0bdc570ea3e97a67bdd426345bfac043101f","observation_id":"92fca5e4-5dba-4953-92f5-b6b871cdcaf6","resolution":{"observed_at":"2026-08-07T01:00:28.431580Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.06556","last_updated":"2023-08-03T15:31:50Z","snapshot_observed_at":"2026-08-05T20:19:31.448717Z","submitted_at":"2023-04-13T14:03:14Z","title":"Are LLMs All You Need for Task-Oriented Dialogue?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.06556","snapshot_observed_at":"2026-08-07T01:00:24.978197Z","title":"V ojtˇech Hudeˇcek and Ondˇrej Dušek","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:24.978197Z"},"links":{"cited_paper":"/paper/2304.06556","citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:b6407471a33caf1f5eb76de29e31121783c04ca84fae93ff0c2c8acc7146e735","observation_id":"c73e1495-cefe-434e-af8c-9346d1485ed1","resolution":{"observed_at":"2026-08-07T01:00:24.978197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.805930Z","title":"The agent provides information about the restaurant, such as its name, location, cuisine, price, rating, etc","venue":null,"work_id":"8dd6ea24-531e-4ae7-88e8-dacacd3ff980","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.758620Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:9014cd61066f4dba7fdf4ce2945f7e11326571c99b326655c012291031065a40","observation_id":"360be9e6-0f3b-4aec-acef-f2d6375f7a11","resolution":{"observed_at":"2026-08-07T01:00:27.868431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.501990Z","title":"The agent provides information about the booking, such as the restaurant name, reservation date, reservation time, number of guests, price, etc","venue":null,"work_id":"eb3317ae-05fa-4378-a184-0b6999c4bd93","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.848139Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:04ecbbde35963d35747ec51e9bd6b5edaeea1e9ad25c1d8112f62d3857749819","observation_id":"0e8782f8-6744-4f8f-a9b3-3b1918f925ca","resolution":{"observed_at":"2026-08-07T01:00:27.641289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:28.565310Z","title":"In Pro- ceedings of the AAAI Conference on Artificial Intelli- gence, volume 38, pages 19368–19376","venue":null,"work_id":"02972b62-8112-4098-9a5e-38611aed3690","year":2022},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.202303Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:d028c60a1dddc82346155e8d683d27ff16c5272c77ef975d30b3bf83202bb204","observation_id":"f4a9bd9f-5156-4201-9817-8f8e00700d7a","resolution":{"observed_at":"2026-08-07T01:00:28.640842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:28.209721Z","title":"I recommend","venue":null,"work_id":"f05de700-cb75-4ba8-9f6f-6b2940cf3eab","year":2021},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.483359Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:eefe001c6ead17cbc88acf23e1c067026cbcbb9d865e9da56cb6ddb31aca0bfa","observation_id":"6f07d45b-8fa8-48a4-a794-ce02af45fdad","resolution":{"observed_at":"2026-08-07T01:00:28.266621Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:28.072697Z","title":"The agent provides information about the hotel, such as its name, location, price, rating, etc","venue":null,"work_id":"7a8ccc2a-d9ce-4516-ac2f-063eaf06dfd3","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.565442Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:02d2489be987742e1867e2d3863d2310379f53fc82abcaf4eb90cce0a75c5ec8","observation_id":"84f4b4b2-0e56-487e-a367-2f7fcf62cc9c","resolution":{"observed_at":"2026-08-07T01:00:28.117312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.962915Z","title":"The agent may provide information about the booking, such as the hotel name, check-in date, check-out date, number of guests, price, etc","venue":null,"work_id":"424fdb29-489e-4a4a-af00-6c0a0d601824","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.645908Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:00589d0f702fec65d00683a6950eedc7244f5feecafb7d616eac3727d0e76df0","observation_id":"61a68466-e2e5-48dc-8889-8067c13568a8","resolution":{"observed_at":"2026-08-07T01:00:28.006217Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.363575Z","title":null,"venue":null,"work_id":"e7a862cb-d7e3-49b0-b165-ac570dbbd0e5","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.928658Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:add08a8194aec0abb483758109dc9a66e5eefdb0c76240d9fc5129f734a0d6f5","observation_id":"faa85dfa-a5c4-4586-b252-da26cc5fca5c","resolution":{"observed_at":"2026-08-07T01:00:27.432617Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.199418Z","title":null,"venue":null,"work_id":"ccb39b72-12bf-4ba7-ad86-0cc9ce8146e3","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:26.056784Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:17b25880270f98b93788830b6ed9e4c5bbfde98c411a42ed040530833c8691e3","observation_id":"66106c79-9376-434b-b8ab-61dd60d2adc4","resolution":{"observed_at":"2026-08-07T01:00:27.275164Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:27.002239Z","title":null,"venue":null,"work_id":"51df958f-45ff-4a6a-8137-fac9a8176ca4","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:26.148815Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:22a6c7a3162e9df977b0594625ed183bee3421d6340dcd7191a17545138ef498","observation_id":"09249914-84d2-44fd-b075-c767a326e6c1","resolution":{"observed_at":"2026-08-07T01:00:27.104917Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T01:00:26.820205Z","title":null,"venue":null,"work_id":"26e6e8dc-f951-4c01-b8d7-2f75c2f3ff24","year":null},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:26.218590Z"},"links":{"citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:0a79e79d4fd0d4c125f486a4db81640ac52c15838464e3e27994f407923b2048","observation_id":"a2d4de67-a31f-4cc7-af26-6233bb852452","resolution":{"observed_at":"2026-08-07T01:00:26.909431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2007.12720","last_updated":"2020-07-10T22:52:14Z","snapshot_observed_at":"2026-07-06T09:41:38.009989Z","submitted_at":"2020-07-10T22:52:14Z","title":"MultiWOZ 2.2 : A Dialogue Dataset with Additional Annotation Corrections and State Tracking Baselines","version":1},"cited_work":{"arxiv_id":"2007.12720","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.12720","snapshot_observed_at":"2026-08-07T01:00:26.381022Z","title":"MultiWOZ 2.2 : A Dialogue Dataset with Additional Annotation Corrections and State Tracking Baselines","venue":"cs.CL","work_id":"9431103b-b69e-4165-b453-bf72dc7f0f31","year":2020},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.298039Z"},"links":{"cited_paper":"/paper/2007.12720","citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:3dab34aa18da0df658d478831c98ceb57e4e3e9599a20b38371b00a1f9b2ab91","observation_id":"2c509012-5ba4-4d9d-a3e7-f6dbcccb3ae4","resolution":{"observed_at":"2026-08-07T01:00:26.473756Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.05855","last_updated":"2020-01-29T18:57:49Z","snapshot_observed_at":"2026-08-03T15:38:41.702117Z","submitted_at":"2019-09-12T17:57:57Z","title":"Towards Scalable Multi-domain Conversational Agents: The Schema-Guided Dialogue Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.05855","snapshot_observed_at":"2026-08-07T01:00:25.045981Z","title":"Advances in neural in- formation processing systems, 35:27730–27744","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.045981Z"},"links":{"cited_paper":"/paper/1909.05855","citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:bb504140d228fcea42a13e8c78bd00f6bfef58fc96aca76dd2818c9f1b527a06","observation_id":"70420777-962f-4172-bb15-c0df4ebfc55f","resolution":{"observed_at":"2026-08-07T01:00:25.045981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.16798","last_updated":"2023-05-26T10:19:30Z","snapshot_observed_at":"2026-08-05T00:25:38.974560Z","submitted_at":"2023-05-26T10:19:30Z","title":"Schema-Guided User Satisfaction Modeling for Task-Oriented Dialogues","version":1},"cited_work":{"arxiv_id":"2305.16798","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.16798","snapshot_observed_at":"2026-08-07T01:00:26.636201Z","title":"Schema-Guided User Satisfaction Modeling for Task-Oriented Dialogues","venue":"cs.CL","work_id":"be8b3a92-35b1-4c3b-a10e-83bb78961bf4","year":2023},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:24.903706Z"},"links":{"cited_paper":"/paper/2305.16798","citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:6ccba171e61c0947d5eaae14fb33510ba2a078b1053c1054a4eca780a06ad461","observation_id":"8a2e5c0f-5409-499d-9706-7afdec5088a7","resolution":{"observed_at":"2026-08-07T01:00:26.705272Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T01:00:25.117681Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T01:00:25.117681Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.12266"},"observation_digest":"sha256:feb359af1212f1aaf91b7fe4b39ae442410c807b8fc52d4edf523f4ba5a5d4f3","observation_id":"0fd396b2-f666-4ce0-9509-1fc611b62bcb","resolution":{"observed_at":"2026-08-07T01:00:25.117681Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.12266","last_updated":"2025-06-13T22:36:41Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-08T03:01:20.180655Z","submitted_at":"2025-06-13T22:36:41Z","title":"The Behavior Gap: Evaluating Zero-shot LLM Agents in Complex Task-Oriented Dialogs"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":8,"verified_exact":1,"verified_fuzzy":6},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2506.12266."}