{"as_of":"2026-08-08T10:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7a49b8b8afae9477727c63cfbac529ca336280a53afc2a252f471f79b2895840","coverage":[{"denominator":18,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":18,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T21:45:00.896630Z","state":"measured"},{"denominator":20,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":20,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-15T21:51:10.972744Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-15T21:51:40.816217Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"cited_work":{"arxiv_id":"2506.23667","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23667","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"L0: Reinforcement learning to become general agents","venue":null,"work_id":"388665da-4d0c-4789-93cd-be119432eff1","year":2025},"citing_paper":{"arxiv_id":"2603.16876","last_updated":"2026-05-08T08:14:14Z","snapshot_observed_at":"2026-08-02T05:44:39.173956Z","submitted_at":"2026-02-17T12:48:32Z","title":"Multi-Modal Multi-Agent Reinforcement Learning for Radiology Report Generation","version":2},"reference_index":140,"source":"pdf_text","source_observed_at":"2026-05-15T21:51:10.972744Z"},"links":{"cited_paper":"/paper/2506.23667","citing_paper":"/paper/2603.16876"},"observation_digest":"sha256:bf5af88b8a04c7542f66583eab3b0a9d1b2b8b7a0ec7a1c57e299851e483b037","observation_id":"7f6b2a6f-fb70-41df-906c-053903ef2397","resolution":{"observed_at":"2026-05-15T21:51:40.820434Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"cited_work":{"arxiv_id":"2506.23667","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.23667","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"L0: Reinforcement learning to become general agents","venue":null,"work_id":"388665da-4d0c-4789-93cd-be119432eff1","year":2025},"citing_paper":{"arxiv_id":"2605.02913","last_updated":"2026-04-08T00:53:29Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-04-08T00:53:29Z","title":"Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning","version":1},"reference_index":173,"source":"arxiv_source","source_observed_at":"2026-05-10T19:15:27.406778Z"},"links":{"cited_paper":"/paper/2506.23667","citing_paper":"/paper/2605.02913"},"observation_digest":"sha256:2a22d61cc75681782c6cc3f23564a5f540d03933f20876de1aa7916de332ee39","observation_id":"1309c335-5c4e-4801-9ba6-78bcd1cdb231","resolution":{"observed_at":"2026-05-10T23:15:49.725122Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.23667/citation-record","integrity":"/paper/2506.23667/integrity","json":"/paper/2506.23667/citation-record.json","paper":"/paper/2506.23667"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.10978","last_updated":"2025-10-28T15:11:36Z","snapshot_observed_at":"2026-07-29T19:20:21.974239Z","submitted_at":"2025-05-16T08:26:59Z","title":"Group-in-Group Policy Optimization for LLM Agent Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10978","snapshot_observed_at":"2026-08-06T21:44:59.706854Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-06T21:44:59.706854Z"},"links":{"cited_paper":"/paper/2505.10978","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:94f6396415945ba3a0f27cc3443bc9d68beec1198d75e754be79ae35bbc1ea04","observation_id":"bef74cd5-63f2-434e-a12e-c43090396fe9","resolution":{"observed_at":"2026-08-06T21:44:59.706854Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T21:44:59.778161Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-06T21:44:59.778161Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:004f2d3d883b026fe9cb3a4fb3ba837efab13464fd82da671e3398e10de9b9f1","observation_id":"8608f17b-f4a3-47d9-a94b-ba8cc8b87810","resolution":{"observed_at":"2026-08-06T21:44:59.778161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:02.704798Z","title":null,"venue":null,"work_id":"6f1e04a8-c8a3-410d-9b40-cb5749ecbee2","year":2020},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-06T21:44:59.884891Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:7d8e0419d8c2f029b4a89df0a8d199a10c776a2f4e0ce03e62f251fd5d80cb62","observation_id":"1ff586b0-bb82-4514-b5a2-ad612c94b987","resolution":{"observed_at":"2026-08-06T21:45:02.773356Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:02.488403Z","title":null,"venue":null,"work_id":"75d3fdd2-d575-4f8a-9198-5fc02a5cdc95","year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-06T21:44:59.933455Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:f0570d2ad948bf76654d0dd389e9f80c1da36f523b458953dd685a11210c953c","observation_id":"899f4bf4-0f05-44c5-bd4e-30cd78ef346f","resolution":{"observed_at":"2026-08-06T21:45:02.597391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07489","last_updated":"2024-09-13T08:26:23Z","snapshot_observed_at":"2026-07-06T19:13:55.363649Z","submitted_at":"2024-09-08T00:23:37Z","title":"RAGent: Retrieval-based Access Control Policy Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07489","snapshot_observed_at":"2026-08-06T21:45:00.007761Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.007761Z"},"links":{"cited_paper":"/paper/2409.07489","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:821961276511c6aed78e9c4492298cf41832606fab250da4bed8743e32e317c5","observation_id":"72fa6a89-92e5-439a-b933-439aa24f0a6a","resolution":{"observed_at":"2026-08-06T21:45:00.007761Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09516","last_updated":"2025-08-05T19:08:38Z","snapshot_observed_at":"2026-07-06T20:51:28.022519Z","submitted_at":"2025-03-12T16:26:39Z","title":"Search-R1: Training LLMs to Reason and Leverage Search Engines with Reinforcement Learning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09516","snapshot_observed_at":"2026-08-06T21:45:00.084961Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.084961Z"},"links":{"cited_paper":"/paper/2503.09516","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:be589a026c7705f53208160c4e21ba089aa742bdcf341b9b86449d467df0d9ba","observation_id":"7acf283a-68bb-4849-8f3f-ee404e39634e","resolution":{"observed_at":"2026-08-06T21:45:00.084961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:02.320359Z","title":null,"venue":null,"work_id":"93cfa09d-992d-4337-adcd-9c15a037c9c5","year":2017},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.190054Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:2c6953c1290db4f0a1e62a431a43c8f76c39c42d6c6a7078e7afa7204e9c3a87","observation_id":"fa7a83f0-e58a-4379-86a5-f54943bd6301","resolution":{"observed_at":"2026-08-06T21:45:02.398920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:02.181074Z","title":null,"venue":null,"work_id":"3e387cfa-ec4d-40ba-8af6-b6932d2a7f1a","year":2019},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.264906Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:8c37340004e8de44fc96fefa1abad54e0bd1e81d958c64eaab756298ff7b098f","observation_id":"0371d9fe-77f0-4a83-8b55-39be7cf64e4a","resolution":{"observed_at":"2026-08-06T21:45:02.224600Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.05366","last_updated":"2025-01-09T16:48:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-09T16:48:17Z","title":"Search-o1: Agentic Search-Enhanced Large Reasoning Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.05366","snapshot_observed_at":"2026-08-06T21:45:00.349407Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.349407Z"},"links":{"cited_paper":"/paper/2501.05366","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:6333fac6ac02dae1f5835111fb1db8541754c3455870e40b2adce016b22bd56f","observation_id":"9f9a0550-db7d-461b-b08a-5dabcfa900b1","resolution":{"observed_at":"2026-08-06T21:45:00.349407Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.985287Z","title":null,"venue":null,"work_id":"1ef0f36f-b25d-49c7-82c1-3e3a838e7555","year":2023},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.408556Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:46583348c4358485d2e36f217b8014b54d41534c37b074e7e8afa419c5055be0","observation_id":"8063a002-7b35-4e2b-bd16-40aca3581f7f","resolution":{"observed_at":"2026-08-06T21:45:02.072346Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.04588","last_updated":"2026-05-19T11:51:42Z","snapshot_observed_at":"2026-08-04T18:36:41.979541Z","submitted_at":"2025-05-07T17:30:22Z","title":"ZeroSearch: Incentivize the Search Capability of LLMs without Searching","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04588","snapshot_observed_at":"2026-08-06T21:45:00.471283Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.471283Z"},"links":{"cited_paper":"/paper/2505.04588","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:97f446bb5be9e6f6603e3ca0b5db8142d9f2087f35717af3b2f3e616d948bc08","observation_id":"10349242-37f1-4f2e-b007-f0b20d7ab42a","resolution":{"observed_at":"2026-08-06T21:45:00.471283Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.794077Z","title":null,"venue":null,"work_id":"713d6486-4ddb-429a-9c44-68ef2e21ba65","year":2022},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.537973Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:8875b9b41b14cfd51e5ab9e920a0f5a8b21c946c1c4f00fd161939dd8556d250","observation_id":"6394dd20-57cb-42e8-b990-3c0703ba3894","resolution":{"observed_at":"2026-08-06T21:45:01.893036Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.653696Z","title":null,"venue":null,"work_id":"a6131543-cd7e-4d6a-a67a-3746a6ff551f","year":2024},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.588082Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:5acf59c8fbf15e9ab9f183a629178c310175b6b3340709fca98b9e3cb8fc54a1","observation_id":"b553d063-6f8b-41cf-a758-fb45b1b0bfd6","resolution":{"observed_at":"2026-08-06T21:45:01.720030Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.473067Z","title":null,"venue":null,"work_id":"fdb3f8c4-917b-4094-9807-9098f5038d28","year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.635927Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:f9912f1ebe57c043524f462a10729d721e363f2c4195623d060b9e4059ab03a2","observation_id":"f7fbddeb-c4cf-4e61-afac-b28e34b7a3a4","resolution":{"observed_at":"2026-08-06T21:45:01.551841Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.04368","last_updated":"2024-11-07T01:58:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-07T01:58:42Z","title":"Measuring short-form factuality in large language models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.04368","snapshot_observed_at":"2026-08-06T21:45:00.718465Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.718465Z"},"links":{"cited_paper":"/paper/2411.04368","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:c2aa7e2eedfdaaf6dfe579a476c78ecd4896b56fdd2bdd2aaa337701bb98455e","observation_id":"e091268f-41eb-4008-bc86-6a39117b640e","resolution":{"observed_at":"2026-08-06T21:45:00.718465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T21:45:00.782069Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.782069Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:af45ab882df8f40011c0a84eb414bf19c7cd9b5b0e9088d4ab6c0a1ac7b3626c","observation_id":"8a587171-c7c8-4a4d-b714-114a72425a2e","resolution":{"observed_at":"2026-08-06T21:45:00.782069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.262894Z","title":null,"venue":null,"work_id":"ac03645f-58d6-4a04-9311-fbb51df1abbf","year":2018},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.834498Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:cc534ba98d6a6b2c0d0500ebbdcde4951ca51a1d4a24287eedb18333b02919e8","observation_id":"51f948a6-9df1-4632-a191-5819d4b31832","resolution":{"observed_at":"2026-08-06T21:45:01.382091Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T21:45:01.111597Z","title":null,"venue":null,"work_id":"e1b3a3d6-b8e1-47f0-b31e-7c8372500a37","year":2025},"citing_paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-06T21:45:00.896630Z"},"links":{"citing_paper":"/paper/2506.23667"},"observation_digest":"sha256:63285ab496f49cf86c9d7f1dab9fa8f26c2ac135d3a445aa2b75a474910d0bae","observation_id":"9caf3835-4d4d-403e-ba6c-4f0e747b91a4","resolution":{"observed_at":"2026-08-06T21:45:01.188222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.23667","last_updated":"2025-06-30T09:44:32Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T21:32:28.224714Z","submitted_at":"2025-06-30T09:44:32Z","title":"L0: Reinforcement Learning to Become General Agents"},"reference_resolution":{"displayed":18,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":18,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":18},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 18 of 18 outbound references and 2 inbound Pith citation observations for arXiv:2506.23667."}