{"as_of":"2026-08-09T12:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:12e58bc4b147515c1bbbe04432ff782038505d30baa7bca9048a5610e248f0ea","coverage":[{"denominator":23,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":23,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T18:06:21.803962Z","state":"measured"},{"denominator":23,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":23,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.15207/citation-record","integrity":"/paper/2508.15207/integrity","json":"/paper/2508.15207/citation-record.json","paper":"/paper/2508.15207"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:24.683187Z","title":"Google’s self-driving car caused its first crash,","venue":null,"work_id":"c011df85-03be-41c7-b5c0-1fda70e8c9bb","year":2016},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.054418Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:11e9c2b0b99786ee978d9334f5b3a68a716d69771a61c4963aeea66c3c0fb29f","observation_id":"264b692a-95bf-46e2-ac61-519340b00c1e","resolution":{"observed_at":"2026-08-05T18:06:24.762552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.5602","last_updated":"2013-12-19T16:00:08Z","snapshot_observed_at":"2026-07-06T03:31:23.521122Z","submitted_at":"2013-12-19T16:00:08Z","title":"Playing Atari with Deep Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.5602","snapshot_observed_at":"2026-08-05T18:06:19.132220Z","title":"Playing atari with deep reinforcement learning,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.132220Z"},"links":{"cited_paper":"/paper/1312.5602","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:f7606a6dc87b4195a4d266a9cd676b8071b043ecf315eb14b978e678fdd996f9","observation_id":"4b6b0532-a916-4f97-a209-c3acb09bd230","resolution":{"observed_at":"2026-08-05T18:06:19.132220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:24.467518Z","title":"A general reinforcement learning algorithm that masters chess, shogi, and go through self-play,","venue":null,"work_id":"0c38521a-f343-405f-9b46-c62eee160fe5","year":2018},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.279134Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:31095f71826d047722d056e5afd407210efbd7ad8762c6af04b4894bcd91bfa9","observation_id":"93b01042-82c4-406d-9494-1ca35af77a26","resolution":{"observed_at":"2026-08-05T18:06:24.569321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:24.241358Z","title":"Control of a quadrotor with reinforcement learning,","venue":null,"work_id":"c524a852-082f-466a-876e-20dfea64bf20","year":2096},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.498251Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:b64b1a2e4544c56e5c6251e59e87bbe1e200afc1ad5fcbb98a05ed9243500680","observation_id":"52947855-e5ca-4456-81eb-b6c6286060da","resolution":{"observed_at":"2026-08-05T18:06:24.347666Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.03295","last_updated":"2016-10-11T12:09:03Z","snapshot_observed_at":"2026-08-03T05:49:14.071341Z","submitted_at":"2016-10-11T12:09:03Z","title":"Safe, Multi-Agent, Reinforcement Learning for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.03295","snapshot_observed_at":"2026-08-05T18:06:19.594079Z","title":"Safe, multi- agent, reinforcement learning for autonomous driving,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.594079Z"},"links":{"cited_paper":"/paper/1610.03295","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:a4535300e069a92d530556bea0a6087322c7a1999ae8c5deb75d2e3f9adff050","observation_id":"e8a13fdb-569f-4730-8c31-cb11d68e3880","resolution":{"observed_at":"2026-08-05T18:06:19.594079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:23.736231Z","title":"Deep reinforcement learning framework for autonomous driv- ing,","venue":null,"work_id":"3abd7c73-9c45-40c4-b1ee-a61179909650","year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:19.774379Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:e042b3c22bb6235cbd93a2a77c548da56824d245cdf4991549a5bcf4ffc416c9","observation_id":"d07babeb-f4d1-4480-928e-ccd3756a7513","resolution":{"observed_at":"2026-08-05T18:06:23.854139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:23.529155Z","title":"Formulation of deep reinforcement learning architecture toward autonomous driving for on-ramp merge,","venue":null,"work_id":"1fa625d9-a328-4437-9b07-caee01edb2b2","year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.061997Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:b4d69d407916e83693c8eefeb294b55aab8faba788eff2d1519584243bc27eb1","observation_id":"f165d015-6cde-478d-a211-3fa4fceddf05","resolution":{"observed_at":"2026-08-05T18:06:23.611712Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:23.992917Z","title":"Deep rein- forcement learning framework for autonomous driving,","venue":null,"work_id":"cc9d8cf3-0af1-46eb-9da4-190447f4f456","year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.174923Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:92b6b12303a5aa35989be09a4e3cb4b726b72de61a0efb94812c654b83fdca17","observation_id":"85ccae27-6318-47eb-bca3-cbc5fb7389c7","resolution":{"observed_at":"2026-08-05T18:06:24.106632Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:23.296464Z","title":"Model-free deep reinforcement learning for urban autonomous driving,","venue":null,"work_id":"64d341b2-f386-4c68-a582-a6906975de30","year":2019},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.289914Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:1112fa2c859c2fc6d3b323cf1e31e346c95ca9d2a8159b0875affad47bfd9b81","observation_id":"e9bf95a5-24b6-4131-b415-8a7843fa5926","resolution":{"observed_at":"2026-08-05T18:06:23.396785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1706.02275","last_updated":"2020-03-14T20:33:00Z","snapshot_observed_at":"2026-08-04T19:23:21.346128Z","submitted_at":"2017-06-07T17:35:00Z","title":"Multi-Agent Actor-Critic for Mixed Cooperative-Competitive Environments","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.02275","snapshot_observed_at":"2026-08-05T18:06:20.546964Z","title":"Multi-agent actor-critic for mixed cooperative-competitive environ- ments,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.546964Z"},"links":{"cited_paper":"/paper/1706.02275","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:5b24af4bbde8b10d78e73b403a5a982e4be65d0c14d8b475486cfa3a742b2db8","observation_id":"66b82ebf-efd8-412a-8eaf-817ff9d665d2","resolution":{"observed_at":"2026-08-05T18:06:20.546964Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:23.107367Z","title":"Multi-agent connected autonomous driving using deep reinforcement learning,","venue":null,"work_id":"7ef0d53a-bafc-4295-8785-8c95e240ab1d","year":2020},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.613066Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:7a5f700682bd43524c1eaf280209982db95d8f667f12aef9f41746e22d0c218b","observation_id":"208f168d-7cd5-43fd-8948-4bf10d535744","resolution":{"observed_at":"2026-08-05T18:06:23.194787Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:20.727499Z","title":"An environment for autonomous driving decision- making,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.727499Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:b9ca6ecc4bc364d6cf3b71a37793651f58b06e5b0bf26dbd9a8c0ae3833abc35","observation_id":"b8b05ac8-a726-4e68-9dd4-d911044e2d83","resolution":{"observed_at":"2026-08-05T18:06:20.727499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:22.861315Z","title":"Credit assignment for collective multiagent rl with global rewards,","venue":null,"work_id":"b6e5c955-a0ee-46c4-8c36-fcc74498951c","year":2018},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.805020Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:c6ecf293a17cf192f750a0bd4e113531c445800be1d55af85426b8a81a895be6","observation_id":"8a079827-c55a-4833-9bed-7369c9948b0a","resolution":{"observed_at":"2026-08-05T18:06:22.980420Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6199","last_updated":"2014-02-19T16:33:14Z","snapshot_observed_at":"2026-07-06T03:31:33.797310Z","submitted_at":"2013-12-21T03:36:08Z","title":"Intriguing properties of neural networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6199","snapshot_observed_at":"2026-08-05T18:06:20.918788Z","title":"Intriguing properties of neural networks,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:20.918788Z"},"links":{"cited_paper":"/paper/1312.6199","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:d53f9670f90b591287924487b7e3c4bd1883fdd7fd5b78b64d762d9e13d97060","observation_id":"7b032fa8-9915-4cd0-aa9d-43dfd17c58b0","resolution":{"observed_at":"2026-08-05T18:06:20.918788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:22.683559Z","title":"Robust adversar- ial reinforcement learning,","venue":null,"work_id":"0ea45df5-e1dc-474d-b1f3-3efe13dcd955","year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.012650Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:c3b0cf30232b85f49a3c31e890dd2fa2569712ea30dd3f7fff44a8e2d10fe3d2","observation_id":"d722d826-37a2-4d68-a778-c79abe7dcb74","resolution":{"observed_at":"2026-08-05T18:06:22.770503Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T18:06:21.126759Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.126759Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:85d5e94fa38255e33d1a0bedfb435ec482e330ceedc35df9567f8f951852ae37","observation_id":"ee5788cb-a078-4948-97c3-e4ba22d924aa","resolution":{"observed_at":"2026-08-05T18:06:21.126759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:21.193791Z","title":"Trust region policy optimization,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.193791Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:f1b42d00d6864746b2257cf517acb050b6bd624db2be9742027a5796bf5938dd","observation_id":"5fd5a101-8594-459f-9c70-b1519b8ad06d","resolution":{"observed_at":"2026-08-05T18:06:21.193791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:22.505752Z","title":"Double q-learning,","venue":null,"work_id":"7d65f451-6c25-4b38-9f6f-509f2c721877","year":null},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.331062Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:8797ff9eef55f1ffef378d1d7aa2814889de6639ee2e010f1734d7bedcf60614","observation_id":"f5948e2d-1fe1-4c3a-bef9-a256ee1f2653","resolution":{"observed_at":"2026-08-05T18:06:22.571608Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1509.06461","last_updated":"2015-12-08T21:19:16Z","snapshot_observed_at":"2026-08-07T14:09:19.448496Z","submitted_at":"2015-09-22T04:40:22Z","title":"Deep Reinforcement Learning with Double Q-learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1509.06461","snapshot_observed_at":"2026-08-05T18:06:21.530402Z","title":"Deep reinforcement learning with double q-learning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.530402Z"},"links":{"cited_paper":"/paper/1509.06461","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:3bd9bb4e7941826cb09ef1546019aad549629724d14a82ee53e14aa6dfcfa7ba","observation_id":"6aa42f11-b567-4ec4-988d-c9e61f912d7b","resolution":{"observed_at":"2026-08-05T18:06:21.530402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1802.09477","last_updated":"2018-10-22T17:37:07Z","snapshot_observed_at":"2026-07-06T06:25:26.844090Z","submitted_at":"2018-02-26T17:54:49Z","title":"Addressing Function Approximation Error in Actor-Critic Methods","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1802.09477","snapshot_observed_at":"2026-08-05T18:06:21.622214Z","title":"Addressing function approximation error in actor-critic methods,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.622214Z"},"links":{"cited_paper":"/paper/1802.09477","citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:998fe1d7c61556e44ae3ae01193c69c085f6012848fc64cf763e441b13e81c8f","observation_id":"a58a6028-d235-4a0a-86ee-f777a02c4985","resolution":{"observed_at":"2026-08-05T18:06:21.622214Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:22.086554Z","title":"General lane-changing model mobil for car-following models,","venue":null,"work_id":"4967eb5c-81b8-4ed5-b832-ea1711a6d903","year":1999},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.690871Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:a28adf32d2aafbde4df43a97f87df26bdfd02e4255f64f44f3f80628b2d93535","observation_id":"daac7fb7-af44-4a12-af6f-c22691381a86","resolution":{"observed_at":"2026-08-05T18:06:22.188142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:21.803962Z","title":"Congested traffic states in empirical observations and microscopic simulations,","venue":null,"work_id":null,"year":2000},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.803962Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:1caff15aaf30df1a85a6b12f002addb956fc73c8c143ebd3d97daf1c925e4fe5","observation_id":"4268a574-b55c-4fec-82cb-315a9bc5624b","resolution":{"observed_at":"2026-08-05T18:06:21.803962Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T18:06:22.254512Z","title":"Available: https://proceedings.neurips.cc/paper/2010/ file/091d584fced301b442654dd8c23b3fc9-Paper.pdf","venue":null,"work_id":"a07135ff-4f4f-440e-a7c3-b54a25ec0625","year":2010},"citing_paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning","version":1},"reference_index":2010,"source":"pdf_text","source_observed_at":"2026-08-05T18:06:21.434666Z"},"links":{"citing_paper":"/paper/2508.15207"},"observation_digest":"sha256:36778bc6ce39ef70dd5b1b90d7eecb77ea0cabce7bd02ccf41ccd52d56cb6f6b","observation_id":"1abb735b-1f07-4d31-b938-d405f7c1ce7f","resolution":{"observed_at":"2026-08-05T18:06:22.377868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2508.15207","last_updated":"2025-08-21T03:38:33Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T12:33:23.419394Z","submitted_at":"2025-08-21T03:38:33Z","title":"Adversarial Agent Behavior Learning in Autonomous Driving Using Deep Reinforcement Learning"},"reference_resolution":{"displayed":23,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":13},"total_outbound_references":23},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 23 of 23 outbound references and 0 inbound Pith citation observations for arXiv:2508.15207."}