{"as_of":"2026-08-15T00:14:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:bac9d7e9036e2fc280e9b81829a1f4ffba61e1c84a2a1d5e9d1312f491dee213","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T07:01:12.737217Z","state":"measured"},{"denominator":76,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":76,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T00:58:55.138958Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.19370","snapshot_observed_at":"2026-08-01T00:58:55.138958Z","title":"arXiv preprint arXiv:2606.19370 (2026) 3","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.26005","last_updated":"2026-07-28T17:20:39Z","snapshot_observed_at":"2026-08-10T18:26:07.614604Z","submitted_at":"2026-07-28T17:20:39Z","title":"Pictura: Perspective-View Self-Play at Scale for Driving","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T00:58:55.138958Z"},"links":{"cited_paper":"/paper/2606.19370","citing_paper":"/paper/2607.26005"},"observation_digest":"sha256:5485b55a6126a0a0e3bcf77edc0faef0ba8f8d344734a08a2df6d5b383212a06","observation_id":"84a4b559-3a9f-4818-8034-a162a4e82506","resolution":{"observed_at":"2026-08-01T00:58:55.138958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.19370/citation-record","integrity":"/paper/2606.19370/integrity","json":"/paper/2606.19370/citation-record.json","paper":"/paper/2606.19370"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Silver, A","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:3ca608dab9b4a4ac06d6232e006c7ff753dbb4b2d7bf5d0bb82615b92d070101","observation_id":"0ea5ed91-3f51-4494-bf97-af095cc77301","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14987","last_updated":"2022-03-28T18:00:51Z","snapshot_observed_at":"2026-07-06T12:53:50.496350Z","submitted_at":"2022-03-28T18:00:51Z","title":"Multilingual Knowledge Graph Completion with Self-Supervised Adaptive Graph Alignment","version":1},"cited_work":{"arxiv_id":"2203.14987","doi":"10.48550/arxiv","metadata_source":"doi_reference","pith_arxiv_id":"2203.14987","snapshot_observed_at":"2026-07-09T21:46:34.506658Z","title":"Dickerson","venue":"cs.AI","work_id":"5c2060c6-427c-4321-be22-49ccae439d80","year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2203.14987","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:74d173f5c5b327e20dabb87bc9e9798307526c0c293ab37d64b68730f70aa5dd","observation_id":"5107d478-6da3-4e5d-b215-f36fc40375f4","resolution":{"observed_at":"2026-06-27T07:10:41.631156Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.07312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:49:45.633518Z","title":"Superhuman AI for Stratego using self-play reinforcement learning and test-time search","venue":null,"work_id":"e7ff2ed0-8e85-4358-a776-3bf7af471c4c","year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:7a6fa36f24e46c67f5f79376d6cfaf5d5fa730ec545741e7a22b9d97c2dfe742","observation_id":"9b9e8f63-3cbe-4a77-8a65-bebe6b460ab6","resolution":{"observed_at":"2026-07-03T14:28:32.023992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01584","last_updated":"2025-02-18T14:09:38Z","snapshot_observed_at":"2026-08-13T19:17:19.731606Z","submitted_at":"2024-08-02T21:37:46Z","title":"GPUDrive: Data-driven, multi-agent driving simulation at 1 million FPS","version":3},"cited_work":{"arxiv_id":"2408.01584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2408.01584","snapshot_observed_at":"2026-07-04T06:49:38.028458Z","title":"Gpudrive: Data-driven, multi-agent driving simulation at 1 million fps","venue":null,"work_id":"d7082c39-b299-48e9-a0fd-b2bbcdcabe1e","year":2024},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2408.01584","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:f6c3c978549af0c5a7594ab00d301edb3e5a2db7b3b954a93741ee62d947b607","observation_id":"3d28f576-a02d-4668-8f56-93da6ecfed53","resolution":{"observed_at":"2026-07-03T14:28:32.016770Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03349","last_updated":"2025-02-05T16:41:05Z","snapshot_observed_at":"2026-08-13T14:57:13.801555Z","submitted_at":"2025-02-05T16:41:05Z","title":"Robust Autonomy Emerges from Self-Play","version":1},"cited_work":{"arxiv_id":"2502.03349","doi":"10.48550/arxiv.2502.03349","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.03349","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Robust autonomy emerges from self-play.arXiv preprint arXiv:2502.03349","venue":"ArXiv.org","work_id":"173e9c42-293e-43cf-b7e5-35a05a37b72e","year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2502.03349","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:ac49d1f81e6313b59e398e0333a1d99110fa7ce8b706c8fe292fb9979914b34c","observation_id":"6860ca74-a2ef-4fba-a27f-a32fd183fdf0","resolution":{"observed_at":"2026-07-03T14:28:31.997601Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14706","last_updated":"2025-05-19T23:24:52Z","snapshot_observed_at":"2026-08-08T00:40:04.112380Z","submitted_at":"2025-02-20T16:30:45Z","title":"Building reliable sim driving agents by scaling self-play","version":3},"cited_work":{"arxiv_id":"2502.14706","doi":"10.48550/arxiv.2502.14706","metadata_source":"arxiv_reference","pith_arxiv_id":"2502.14706","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Building reliable sim driving agents by scaling self-play","venue":"ArXiv.org","work_id":"cef926fc-0218-4ec8-9d40-02621f179b62","year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2502.14706","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:7fd7762d6a609568600e738b44b2da58fbd87b7bfff831999651f4556637091e","observation_id":"8fce3c69-d8ce-43d5-8073-2a7433dc3847","resolution":{"observed_at":"2026-07-03T14:28:32.002180Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.18060","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T01:29:22.368575Z","title":"Chang, A","venue":null,"work_id":"df538e76-74b5-42a9-9795-6310211ea55f","year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:bed2aea5687b5664558a609f64aad2bc81b668c9426aa60494bb8c27286da7af","observation_id":"94387fdc-9b23-496d-9ca7-e90855f4a351","resolution":{"observed_at":"2026-07-03T14:28:32.006987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1903.00742","last_updated":"2019-03-11T15:25:43Z","snapshot_observed_at":"2026-08-14T17:08:29.593328Z","submitted_at":"2019-03-02T18:13:25Z","title":"Autocurricula and the Emergence of Innovation from Social Interaction: A Manifesto for Multi-Agent Intelligence Research","version":2},"cited_work":{"arxiv_id":"1903.00742","doi":null,"metadata_source":"pith","pith_arxiv_id":"1903.00742","snapshot_observed_at":"2026-07-04T08:39:42.744676Z","title":"Autocurricula and the Emergence of Innovation from Social Interaction: A Manifesto for Multi-Agent Intelligence Research","venue":"cs.AI","work_id":"8dd03731-eafc-4cdb-afb4-5b9c110912eb","year":2019},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/1903.00742","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:c794ac908557ff22efdf7ec20ceb903efffeb4356e5befc18a12e3c65758fcd5","observation_id":"b4a4f134-9e9f-4cff-848c-a8dc180a3781","resolution":{"observed_at":"2026-07-03T14:28:31.992836Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Bakhtin, D","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:c1107b185a56e9b781e1fb3f64aac59f2e2fc975bfb10f9c81d125ed0929d211","observation_id":"a25cc3d8-257a-4cba-b51b-830a0ca9070b","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:ec40924f68fe3f5316f544e43c6cb292848463a1e8bf1f3c3fd5081a37f92c16","observation_id":"17596bf6-27b7-4110-997b-df6a567d7031","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.16406","last_updated":"2026-03-31T19:39:29Z","snapshot_observed_at":"2026-08-14T00:38:10.610322Z","submitted_at":"2026-03-31T19:39:29Z","title":"Heterogeneous Self-Play for Realistic Highway Traffic Simulation","version":1},"cited_work":{"arxiv_id":"2604.16406","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.16406","snapshot_observed_at":"2026-07-04T01:29:22.348120Z","title":"Heterogeneous Self-Play for Realistic Highway Traffic Simulation","venue":"cs.AI","work_id":"616af401-47c6-4ba4-a15b-9e98f322567e","year":2026},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2604.16406","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:d9dbc6992641a5c52208326f66e0396d832ed51400a50666df6f6e4d8ff3f55d","observation_id":"134b2347-bfbf-4047-b3a4-0041bb3b017c","resolution":{"observed_at":"2026-07-03T14:28:31.987934Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:326257b4c1d925040db87ca05ab07c9c41ce9b6ad3d8a554669dc8e83f733101","observation_id":"851d3e71-26fa-4319-9dc4-dbffbe201764","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":1988},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:a82201df49a14f4e76556e607933a64ead51e757650437f0170c6ed82125a257","observation_id":"af650065-d458-4d30-880f-f8e22dbf3d80","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1604.07316","last_updated":"2016-04-25T16:03:56Z","snapshot_observed_at":"2026-07-06T04:53:59.754200Z","submitted_at":"2016-04-25T16:03:56Z","title":"End to End Learning for Self-Driving Cars","version":1},"cited_work":{"arxiv_id":"1604.07316","doi":"10.48550/arxiv.1604.07316","metadata_source":"pith","pith_arxiv_id":"1604.07316","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"End to End Learning for Self-Driving Cars","venue":"cs.CV","work_id":"3184be8a-a518-4a34-9adf-d8f3bb396533","year":2016},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/1604.07316","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:771fe6cc8cf6df0c7cce06a31e4697bf7c36901fa4adbddbf23f718dcc387a2a","observation_id":"67a4c834-f6c9-4840-9a10-6b35b1a2d376","resolution":{"observed_at":"2026-07-03T14:28:31.985324Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.04535","last_updated":"2024-04-14T22:51:18Z","snapshot_observed_at":"2026-08-13T05:07:43.733997Z","submitted_at":"2023-12-07T18:53:27Z","title":"Trajeglish: Traffic Modeling as Next-Token Prediction","version":2},"cited_work":{"arxiv_id":"2312.04535","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.04535","snapshot_observed_at":"2026-07-03T14:28:31.989208Z","title":"Trajeglish: Traffic modeling as next-token prediction","venue":null,"work_id":"094cb2c4-78e6-49df-8009-b3618ef8f02f","year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2312.04535","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:c21bf155fe3709fabde7fa139069dee46733fc26d357153c59c158f3c7d4587f","observation_id":"99015cde-4015-474b-b73b-80d1af5beea2","resolution":{"observed_at":"2026-07-03T14:28:31.990440Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.08228","last_updated":"2025-09-08T00:53:59Z","snapshot_observed_at":"2026-08-13T13:52:39.724168Z","submitted_at":"2025-06-09T20:54:23Z","title":"Scaling Laws of Motion Forecasting and Planning -- Technical Report","version":2},"cited_work":{"arxiv_id":"2506.08228","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.08228","snapshot_observed_at":"2026-07-04T15:49:58.051270Z","title":"arXiv preprint arXiv:2506.08228 , year=","venue":null,"work_id":"dfe35d03-cdc6-4f73-940e-1ae1ceb82a53","year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2506.08228","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:e2fad92ad2aceea657ef5416e12f54969919fda95dee3867269fc8d13a518485","observation_id":"76983c28-e796-4071-8b88-526edc8796d7","resolution":{"observed_at":"2026-07-03T14:28:31.995209Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12905","last_updated":"2024-06-11T21:13:34Z","snapshot_observed_at":"2026-08-12T23:45:06.578096Z","submitted_at":"2024-06-11T21:13:34Z","title":"PufferLib: Making Reinforcement Learning Libraries and Environments Play Nice","version":1},"cited_work":{"arxiv_id":"2406.12905","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.12905","snapshot_observed_at":"2026-07-04T01:29:22.376416Z","title":"Pufferlib: Making reinforcement learning libraries and environments play nice","venue":null,"work_id":"9dcf0c48-620a-406f-b977-2598122556fe","year":2024},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2406.12905","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:0be85dd2c2cfd0b479b6357bac05577f463106f5f7fb7e110e88d9fd2de78d6a","observation_id":"2ac989f6-7aa7-46f5-a8dc-7aae20cf8587","resolution":{"observed_at":"2026-07-03T14:28:32.004591Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Cornelisse, S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:d73bf28b04466abc931b65143679b6a63746464de3d4de54b9a39a8a9e6625d8","observation_id":"652d8587-64d3-49e4-a417-d5e081bcb3a0","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05125","last_updated":"2022-10-11T03:46:12Z","snapshot_observed_at":"2026-08-14T21:51:36.116349Z","submitted_at":"2022-10-11T03:46:12Z","title":"Human-AI Coordination via Human-Regularized Search and Learning","version":1},"cited_work":{"arxiv_id":"2210.05125","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.05125","snapshot_observed_at":"2026-07-03T14:28:32.008031Z","title":null,"venue":null,"work_id":"25669733-f671-44c6-b54d-f1466fb61e76","year":2022},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2210.05125","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:840ae669c90703eef83c372cb90c7daf54e6dea165d540d5052c50a328b76a95","observation_id":"3e5183fa-752c-4150-a547-c357aeaff82e","resolution":{"observed_at":"2026-07-03T14:28:32.009293Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05492","last_updated":"2022-10-11T14:47:35Z","snapshot_observed_at":"2026-08-13T14:08:17.137534Z","submitted_at":"2022-10-11T14:47:35Z","title":"Mastering the Game of No-Press Diplomacy via Human-Regularized Reinforcement Learning and Planning","version":1},"cited_work":{"arxiv_id":"2210.05492","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2210.05492","snapshot_observed_at":"2026-07-03T14:28:32.017827Z","title":"Mastering the game of no-press diplomacy via human- regularized reinforcement learning and planning","venue":null,"work_id":"0b6aaa47-d539-4b9a-9516-0c07381431eb","year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2210.05492","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:6df63d7c5fba9b21d41f404eb3a080cfc8cac7ee7078c1bc0b3e3445744deb4e","observation_id":"89bee180-a239-401e-93d0-2e56c3f8c4a6","resolution":{"observed_at":"2026-07-03T14:28:32.019117Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19648","last_updated":"2024-06-22T23:47:54Z","snapshot_observed_at":"2026-08-13T00:42:45.868799Z","submitted_at":"2024-03-28T17:56:56Z","title":"Human-compatible driving partners through data-regularized self-play reinforcement learning","version":2},"cited_work":{"arxiv_id":"2403.19648","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.19648","snapshot_observed_at":"2026-07-03T14:28:32.032737Z","title":"Human-compatible driving partners through data- regularized self-play reinforcement learning","venue":null,"work_id":"61197a0b-8489-49ad-81c1-bd2ffbf0cf2f","year":2024},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2403.19648","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:cc819820965dc699e284dad199f9249d4f40b706a9570f63eccc40e0fd598e0d","observation_id":"08cfcf2a-d081-47b4-aa25-41837e4f9568","resolution":{"observed_at":"2026-07-03T14:28:32.034035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.15891","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T01:29:22.384054Z","title":"Learning to drive in new cities without human demonstrations","venue":null,"work_id":"c0cfffb4-a354-408d-bb84-5070c00bc77a","year":2026},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:e867be58b763da6a93a29e9bf69f209359cc5e46f404fdb4930ea75ad91779cb","observation_id":"8b0fb527-dae6-4b09-86bb-966fbb42d115","resolution":{"observed_at":"2026-07-03T14:28:32.031659Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Ettinger, S","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:f3b833f0a9f9c05e795c474bb70eea890b1a307f75eb1cc4946b5b83b68b233c","observation_id":"269ef529-3da8-4ae5-83a1-ed90262334bf","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:0404019646c9c54aa7868a9d90479a82cc90530bd92ae66704e33965dcd67786","observation_id":"48807f52-983c-48c9-b324-ed59759e6feb","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Zhang, J","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:801515340ba89d58c687d75b4e8ae2883b4abea3345bfe58c14b6270fe1e7430","observation_id":"a60ec04c-513f-4803-b807-1d59211887c3","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.07192","doi":"10.48550/arxiv.2510.07192","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Poisoning attacks on llms require a near-constant number of poison samples","venue":"ArXiv.org","work_id":"60539e43-e946-4e78-b94e-8e9b741b1dc1","year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:533bd9acf8019f47d72c30004840ce6ed06c24b4e08d6705a326a75b7d03ddb2","observation_id":"ec6f7790-93ef-46e3-bc3f-91af245e6ee5","resolution":{"observed_at":"2026-07-03T14:28:32.028992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-07-15T18:20:33.362261+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T18:20:33.362261+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:f0dd8e056687900583963be8525bf904928624dfe52bc2970ad28cabf641d0fc","observation_id":"e31f1fec-6acc-476f-836a-221878a52bd9","resolution":{"observed_at":"2026-07-03T14:28:31.999869Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Montali, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:cca8a55d9700aab0ecebcd7fdb03cb5f67d28c9b82cb36c3ba044e3c55433e02","observation_id":"6b3ad9f3-a070-44ea-a82a-8531f31a5a1a","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Waymo safety impact","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:d065503f901e6dbccc4c9c32514d5557614a2816548566ccf7e574c068da5896","observation_id":"0e426351-6144-4784-888c-41b554c5e301","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:1e37c463b922f09394b98ed5c687727c78bf7461d1d2381acfa6816cf6dc6d1d","observation_id":"842f5672-c985-4018-9477-ddf1789a08e0","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:84fff0ae07d370a40771034a05cabda31653628dfb62dc6bd45214132d8e3382","observation_id":"c0efa35f-0bb2-4ae6-8579-deeab5bb0c50","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:75810251981983dcf48763d65aa0e8ec756fb9f9a8828a73800e3ffdb0d66cb0","observation_id":"55283c8a-a08e-430b-87a5-456bd79bd11e","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Jiang, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:907ee80a871fa06c9c4fa67aae03b12b7e717351a38052b146afdf442fa07ea4","observation_id":"3337721e-ee08-4a23-b73e-9546d3053680","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Huang, J","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:1acd29573f95d907871f96c180d2738423f7c60a3febb689746b2a7c7ae3b609","observation_id":"534419cc-7a78-42c7-b39b-e069204b6dd8","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Vinitsky, N","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:47151cb374e9d46c99b7a8c3718872dbf35b1c0ae4a2eeca6b71424ff3c66e69","observation_id":"e6bd5b65-fde3-423f-b637-06d7ff6f3c1a","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Caesar, V","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:fd0f82b746f9e65727a666e11ff3956db692d721c3119779824e5f7ce61ebb96","observation_id":"461ee928-2b1a-4f7c-b4dd-5ea0152df743","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00493","last_updated":"2023-01-02T00:36:22Z","snapshot_observed_at":"2026-08-12T21:55:36.747659Z","submitted_at":"2023-01-02T00:36:22Z","title":"Argoverse 2: Next Generation Datasets for Self-Driving Perception and Forecasting","version":1},"cited_work":{"arxiv_id":"2301.00493","doi":"10.48550/arxiv.2301.00493","metadata_source":"pith","pith_arxiv_id":"2301.00493","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Argoverse 2: Next Generation Datasets for Self-Driving Perception and Forecasting","venue":"cs.CV","work_id":"f2f765af-f0ba-41f1-8dd1-37bf1d134d31","year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2301.00493","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:9279af82be68722f4d73b4dae13a29da569c6c045c86666c989b10ffa5e093af","observation_id":"e91c788e-6006-49e3-ac83-44e25d1fb49b","resolution":{"observed_at":"2026-07-03T14:28:32.014066Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03079","last_updated":"2018-12-07T16:04:00Z","snapshot_observed_at":"2026-08-14T17:46:55.453218Z","submitted_at":"2018-12-07T16:04:00Z","title":"ChauffeurNet: Learning to Drive by Imitating the Best and Synthesizing the Worst","version":1},"cited_work":{"arxiv_id":"1812.03079","doi":null,"metadata_source":"pith","pith_arxiv_id":"1812.03079","snapshot_observed_at":"2026-07-04T20:50:12.092509Z","title":"ChauffeurNet: Learning to Drive by Imitating the Best and Synthesizing the Worst","venue":"cs.RO","work_id":"d4e44793-afd0-4b04-80c9-2d09579a4a17","year":2018},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/1812.03079","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:5c8b587466ae19602f83baca9800a4b754997601f628602041209c03401ccb93","observation_id":"fc8b63b6-e34a-47f8-991a-00af360ff96e","resolution":{"observed_at":"2026-07-03T14:28:32.021397Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Salzmann, B","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:1105b1caad0a53bb5e87498c242d96c6bfaca47e1d8b74fff72210bc218199ef","observation_id":"2604fb09-4cac-4be2-8982-b0a2f5d400d8","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:e97c048e672d264c1a33362678275907bc6dd773bf11dac61c93cdf33ef7a3d0","observation_id":"119113ef-b8d4-4573-a0e9-39393af5a3bd","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Nayakanti, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:d3cd95d655dbfaae198673ae681f7f80fd28ad7612c1ecc8148c525e6b12be64","observation_id":"446cc215-1187-4a5e-a29a-46e690f927ef","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.08417","last_updated":"2022-03-04T20:25:25Z","snapshot_observed_at":"2026-08-14T09:35:46.997338Z","submitted_at":"2021-06-15T20:20:44Z","title":"Scene Transformer: A unified architecture for predicting multiple agent trajectories","version":3},"cited_work":{"arxiv_id":"2106.08417","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2106.08417","snapshot_observed_at":"2026-07-03T14:28:32.010516Z","title":"Scene transformer: A unified architecture for predicting mul- tiple agent trajectories","venue":null,"work_id":"442dc7bd-b88a-40bf-8eeb-9fde67c29a04","year":2021},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2106.08417","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:3adee200d5480688d988038095bb48735976b49631c8b85a0cb606e9158698a8","observation_id":"f1c3141d-37e7-451c-b311-1f6a9bee3056","resolution":{"observed_at":"2026-07-03T14:28:32.011761Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:daf80a383f4e61fe03de50f134db9376f617026fb5fbc6342e29802e3735d526","observation_id":"9707730f-8b8a-4bca-824d-af862846d896","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:1bed7800a0b187d25a2f70eb12d2848ae06eebc3c9a5b83f624a4fa899dfad4c","observation_id":"341d8ffb-6ab7-4971-a322-0b68d9ae2c6a","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:e0476b0437ae238d7a2b89d52946a9e4bff9ee86df7f9e84bfeff232e09ea04c","observation_id":"1adbceda-faa2-4fbf-9d01-0b10dfd15f92","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:a6504c1f34cd8432e4f1dd9b7746f2d85252bda991b032623ec338a8c6de5ffe","observation_id":"e28a1568-66a3-449e-8298-c6b05ea0b9d4","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Zhong, D","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:1e2cb70cf4ad933e08c5057a784cfa532964c06d8ea9bd25bf55ea14a44f4e3d","observation_id":"cc964389-7f70-4d26-8965-03649862c763","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:87e5cc6a8a34114a4e4a5e33b73efef94f411fd062831c538cc42f2247ab4a62","observation_id":"21d0dbaa-785c-4ce1-abac-86959a8919c9","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2404.02524","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T13:39:50.157172Z","title":"Versatile behavior diffusion for generalized traffic agent simulation","venue":null,"work_id":"0de8c09c-ee81-486c-b27a-6ac35bc8b2cc","year":2026},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:711b064ed5cd3e6ae0886cd94d44fddd8a90d5957317b61832ae78a97ea29e72","observation_id":"8efb02ee-377f-49f4-9bf6-c70df3aaa3e8","resolution":{"observed_at":"2026-07-03T14:28:32.026455Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:5f4da3b7b27a4c4f6a0ef1a3aabc090446b14fbc5a07e342d1fc07239d68aff0","observation_id":"9e26cdeb-63fa-4a7a-8b8e-e13b2f3bb331","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:ccc3dc3a65aa1b04f7ecc9fe1c0f46c07673b7400c5e14d2819805cf2067a40f","observation_id":"d8c096d3-a196-42de-9d2f-b183bfb33cf3","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:b0c8bb1f7c4835fe5d524d4be85bc430818305f3fd0721222d3d36d6ee768f73","observation_id":"f730fd88-8a85-41c3-9d35-c8e3c1b11f98","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:e59c29fb712df41fd40502b2715b71cae388f0e3acb2ead4a53b7380a64a28f1","observation_id":"ad647c1e-e405-4835-92b3-bc765f53a71b","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Zhang, P","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:d9e017abb19b8e66be809a9ae412f5427b99cd44cd2527da547fb4b038071aec","observation_id":"28d722f9-87a9-4d0d-9f65-bd5c40722329","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Silver, T","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:2b7658214f09bba44e968e8f6993f99212aed836f43bedb85ef480b8a5a36f63","observation_id":"b2cf6308-b35e-4ecc-baca-23782222af6f","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Vinyals, I","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:1092a0089fd7760b84012983d1116efb672e127dd23431cb6ca68e1933801ede","observation_id":"eba12cba-212f-4bc5-a8f5-48012f197f85","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"other-play","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:18274c606eda20c3786ee2a3464aacd37cabde40e475328843863b7862f3909d","observation_id":"2cc873a1-6281-411f-92dc-dead31d658de","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:d42a3a0dbb9ccf6ff5920a6897c578a02689f5b357549a642a5e8a20ea309d19","observation_id":"a99cc042-5ddf-4099-8e0f-52056a66fca0","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:20259b5ec5eb90d3c05e0a04e16dee7643d3b5f8028c4a4837a16a433a5d882d","observation_id":"2ef35749-1fb4-427d-943d-7e82b651bd7d","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"cond-mat/0002177","last_updated":"2000-08-30T16:31:11Z","snapshot_observed_at":"2026-07-07T01:34:54.194717Z","submitted_at":"2000-02-11T19:26:46Z","title":"Congested Traffic States in Empirical Observations and Microscopic Simulations","version":2},"cited_work":{"arxiv_id":"cond-mat/0002177","doi":"10.1103/physreve.62.1805","metadata_source":"doi_reference","pith_arxiv_id":"cond-mat/0002177","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Congested traffic states in empirical observations and microscopic simulations","venue":"cond-mat.stat-mech","work_id":"84e6e09d-f154-45d3-ad19-9bf48a0276de","year":2000},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/cond-mat/0002177","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:0b66afcc1c4688390c8fbf832dc57f17f924d16ed52aabf2db61109f4398a2a1","observation_id":"84648619-9dc5-4ae1-900f-b5726e0833ea","resolution":{"observed_at":"2026-06-27T07:10:41.629046Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-07T22:38:26.771053+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T22:38:26.771053+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Charraut, W","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:4bf8e6ade7e9d1c945eb3ed6c4277a4c1ae92bdfdfe6601bc136b9db19d349e0","observation_id":"e5cc0035-b68c-4e64-909f-2bea38fa345a","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Dauner, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:c3de4dc256f575039decb1928c157196abae0e2127826285b4fe8ec6f6ec9cd1","observation_id":"e7876903-b5c6-4bbd-be97-8691bbd83acd","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Cornelisse","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:20d6b27cd171405675f1b8ca47c125f642835d2d39dc0092944e69af45879b95","observation_id":"50d526f2-88e1-4b02-b4b5-f3f6c12e4e4c","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.12185","last_updated":"2024-07-16T21:28:03Z","snapshot_observed_at":"2026-08-12T23:20:45.665567Z","submitted_at":"2024-07-16T21:28:03Z","title":"Satisficing Exploration for Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2407.12185","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.12185","snapshot_observed_at":"2026-07-03T14:28:32.035093Z","title":"Arumugam, S","venue":null,"work_id":"1be48bd0-bb71-402b-bca4-3033f48c9837","year":2024},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2407.12185","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:77e407dbc04bfdfa7bbe66a4193ee9df97f2bdb826da1777d98380df87c59550","observation_id":"2da597e3-e5a3-4c5d-8111-ce584d96d267","resolution":{"observed_at":"2026-07-03T14:28:32.036415Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:db4324cf351f3d640e3696b2fe341485e2cca667f771771225bb2d343c815643","observation_id":"8334024d-45e6-4fad-8c7c-95132bbaeec7","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.03220","doi":"10.48550/arxiv.2601.03220","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2601.03220 , year=","venue":"arXiv (Cornell University)","work_id":"bf6f1eb5-a485-4887-bdc7-ac8e7f071c1a","year":2026},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:84799b7df58d22463311393ff0cde2a24693e7e7558a420451985d4ddc9189e2","observation_id":"a9f122cf-3011-4544-a784-d9a6a279d35f","resolution":{"observed_at":"2026-07-03T14:28:32.041470Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10034","last_updated":"2026-05-11T05:59:49Z","snapshot_observed_at":"2026-08-11T12:36:00.077427Z","submitted_at":"2026-05-11T05:59:49Z","title":"Beyond Self-Play and Scale: A Behavior Benchmark for Generalization in Autonomous Driving","version":1},"cited_work":{"arxiv_id":"2605.10034","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.10034","snapshot_observed_at":"2026-07-04T01:29:22.386855Z","title":"Beyond Self-Play and Scale: A Behavior Benchmark for Generalization in Autonomous Driving","venue":"cs.RO","work_id":"d4c20e4e-47d6-424f-abe9-30d7e4d80192","year":2026},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"cited_paper":"/paper/2605.10034","citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:1bd93c175186350be599d5ca9393147ec98919f49e0147b9d5ec62b0d0853100","observation_id":"ae9c7a7a-1bed-4e5e-9f05-c44e63a5aeba","resolution":{"observed_at":"2026-07-03T14:28:32.038757Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Gulino, J","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:49f0ace0f482a38bd2ad60b7d329d4f0cc99a46c79af15f6be5e586928fb3a48","observation_id":"ba717806-e1da-463e-b5e1-00d7d672395a","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"This caps acceleration and braking","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:3b32e7d2cf6b02af6f012fed57b305759a882830243b10f0be87fde75c2ff1a3","observation_id":"5c443e5d-0a5d-4d0e-a07a-577016092dac","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"This eliminates lateral sliding and side-shimmy at low forward speed","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:0be663e337048abc3e4ce9955c3c313da7b5e2f97e1fecbb830c327aa5724998","observation_id":"c4101a52-c2f3-457d-b72d-5da90a0dd8cd","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:b81a113b91bbdcb9aaf62792adc840f6447617bdfcbc27ea32c372b4c8de6677","observation_id":"48820785-acab-43a2-9404-e81a0f8af2cd","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:89431a00042e3feb5d699e6cdb8e239c8d4cd1cde05586cae5d8ef644ee239ec","observation_id":"7f9a816f-cb04-46d3-b602-80a9d9c0dab6","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:8d4bebd9760e26004cf9b57a1a04a5054b1681df6939872b0312946d827e5ba6","observation_id":"a3642519-f4cd-47fa-b89f-96f04bce8e95","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:ea60be81c3318db284cec44806a918282e42e3364e622011943f462a89b50f51","observation_id":"c404db74-2c07-4dc9-8ecc-e21712523810","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T07:01:12.737217Z","title":"Table 10: Interactive evaluation across all scaling checkpoints","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-27T07:01:12.737217Z"},"links":{"citing_paper":"/paper/2606.19370"},"observation_digest":"sha256:4e15afefc327785bf0aa1a2e56782b62c3350e5141adb147218243019fad819d","observation_id":"879fc414-66ca-4f78-a396-84c6d83103c5","resolution":{"observed_at":"2026-06-27T07:01:12.737217Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.19370","last_updated":"2026-06-11T19:16:53Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-13T20:57:01.734746Z","submitted_at":"2026-06-11T19:16:53Z","title":"Human-like autonomy emerges from self-play and a pinch of human data"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":47,"verified_exact":25,"verified_fuzzy":0},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 1 inbound Pith citation observation for arXiv:2606.19370."}