{"as_of":"2026-08-04T23:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:71c51efb7194a6eb27596327a49e2e757e878bcdf08ad33b81f411548636d8a4","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-16T12:29:06.229857Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-09T03:36:57.168246Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T03:45:55.587604Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"cited_work":{"arxiv_id":"2601.15808","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.15808","snapshot_observed_at":"2026-07-09T03:45:55.587604Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","venue":"cs.AI","work_id":"4f60793b-7628-4e88-a712-def1ddd07b59","year":2026},"citing_paper":{"arxiv_id":"2604.18131","last_updated":"2026-04-20T11:54:20Z","snapshot_observed_at":"2026-07-06T23:05:04.279268Z","submitted_at":"2026-04-20T11:54:20Z","title":"Training LLM Agents for Spontaneous, Reward-Free Self-Evolution via World Knowledge Exploration","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T04:36:27.381942Z"},"links":{"cited_paper":"/paper/2601.15808","citing_paper":"/paper/2604.18131"},"observation_digest":"sha256:d36b5ddcd343aa646e277d62940619db3a4871c97025ee6540866b87164b20d6","observation_id":"f72d902f-f82e-445b-88b4-4500d7bcc4df","resolution":{"observed_at":"2026-05-10T12:10:23.484189Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"cited_work":{"arxiv_id":"2601.15808","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.15808","snapshot_observed_at":"2026-07-09T03:45:55.587604Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","venue":"cs.AI","work_id":"4f60793b-7628-4e88-a712-def1ddd07b59","year":2026},"citing_paper":{"arxiv_id":"2605.01489","last_updated":"2026-05-26T13:12:52Z","snapshot_observed_at":"2026-07-06T23:14:43.034336Z","submitted_at":"2026-05-02T15:26:45Z","title":"SciResearcher: Scaling Deep Research Agents for Frontier Scientific Reasoning","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-09T14:18:14.048230Z"},"links":{"cited_paper":"/paper/2601.15808","citing_paper":"/paper/2605.01489"},"observation_digest":"sha256:509c35fc47a1cac616469569143888a565e47b97fc6f0d8f971a73de575993bd","observation_id":"bc690305-63b0-4174-98fa-5d095c2462be","resolution":{"observed_at":"2026-05-11T17:01:08.148937Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"cited_work":{"arxiv_id":"2601.15808","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.15808","snapshot_observed_at":"2026-07-09T03:45:55.587604Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","venue":"cs.AI","work_id":"4f60793b-7628-4e88-a712-def1ddd07b59","year":2026},"citing_paper":{"arxiv_id":"2607.07663","last_updated":"2026-07-08T17:19:50Z","snapshot_observed_at":"2026-07-30T01:44:04.256851Z","submitted_at":"2026-07-08T17:19:50Z","title":"Recursive Self-Improvement in AI: From Bounded Self-Refinement to Autonomous Research Loops","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-07-09T03:36:57.168246Z"},"links":{"cited_paper":"/paper/2601.15808","citing_paper":"/paper/2607.07663"},"observation_digest":"sha256:39c54181743868b7341e9ff1bb006bd1de5d9bafcbcd76e673c98b618a7056a5","observation_id":"c513d312-eab5-4b6a-9e8b-b56cbce3139b","resolution":{"observed_at":"2026-07-09T03:45:55.589146Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2601.15808/citation-record","integrity":"/paper/2601.15808/integrity","json":"/paper/2601.15808/citation-record.json","paper":"/paper/2601.15808"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08445","last_updated":"2024-12-11T15:09:54Z","snapshot_observed_at":"2026-07-06T20:05:18.939982Z","submitted_at":"2024-12-11T15:09:54Z","title":"TapeAgents: a Holistic Framework for Agent Development and Optimization","version":1},"cited_work":{"arxiv_id":"2412.08445","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.08445","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Tapeagents: a holistic framework for agent development and optimization","venue":null,"work_id":"a00e1ebd-aa6e-45e7-a202-836bfd85e8d8","year":2024},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2412.08445","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:ad97a50905f8f22ae7ee08d62bb7aa0d2262f037c5f67a096e4d67fdfe503ee4","observation_id":"b4d81aeb-84e0-4f0d-a949-39facba0d072","resolution":{"observed_at":"2026-05-16T12:30:53.857510Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13651","last_updated":"2025-06-16T16:16:14Z","snapshot_observed_at":"2026-07-06T21:43:03.415527Z","submitted_at":"2025-06-16T16:16:14Z","title":"xbench: Tracking Agents Productivity Scaling with Profession-Aligned Real-World Evaluations","version":1},"cited_work":{"arxiv_id":"2506.13651","doi":"10.48550/arxiv.2506.13651","metadata_source":"pith","pith_arxiv_id":"2506.13651","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"xbench: Tracking agents productivity scaling with profession-aligned real-world evaluations","venue":"cs.LG","work_id":"b7f0bdf6-3821-4735-b55e-be58f6ef326d","year":2025},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2506.13651","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:93c52ccf0d5b71da2d58da164b7402b3261a564f7c58837a7402d6dcf9496152","observation_id":"8d64e2b4-bdb0-42d8-bfb6-0611144d6125","resolution":{"observed_at":"2026-05-16T12:30:53.853442Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"KCTS: knowledge-constrained tree search decoding with token-level hallucination detection","venue":null,"work_id":"d5fb9e4a-100e-4d60-aa46-805e499ddb4a","year":2023},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:614a58d2e2fb0036cae2eaf6fb91656c3c9b0a467427c7832cc7106ade27570d","observation_id":"71ebb346-b115-4363-8325-d79ca0f34d83","resolution":{"observed_at":"2026-05-16T12:30:54.310156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.867","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"URL https://doi.org/10.18653/v1/2023.emnlp-main.867","venue":null,"work_id":"a792578b-304b-4fd9-8766-d9d7b6b435cf","year":2023},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:282ab237001855562a24b4c679cff9f1c017db8991ba062cace1c8904b990e43","observation_id":"31f93883-e168-42d1-9d4b-d7876a02e6d5","resolution":{"observed_at":"2026-05-16T12:30:53.793557Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21024","last_updated":"2025-08-21T05:55:43Z","snapshot_observed_at":"2026-07-06T21:16:36.894196Z","submitted_at":"2025-04-23T02:54:31Z","title":"WebEvolver: Enhancing Web Agent Self-Improvement with Coevolving World Model","version":2},"cited_work":{"arxiv_id":"2504.21024","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.21024","snapshot_observed_at":"2026-07-04T17:50:00.061649Z","title":"Webevolver: Enhancing web agent self-improvement with coevolving world model","venue":null,"work_id":"8649f9a0-9fc5-4a04-a2ac-45e2537dd314","year":2025},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2504.21024","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:85cbade9b5a7c2c82d64f94f68a43ff40b2ccd20c4e8b54ebf5c7327df16f118","observation_id":"b96ad2a7-3a35-4532-953a-5050d2e65b44","resolution":{"observed_at":"2026-05-16T12:30:53.875593Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.17746","last_updated":"2025-10-03T01:55:55Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-23T17:57:55Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","version":2},"cited_work":{"arxiv_id":"2507.17746","doi":"10.48550/arxiv.2507.17746","metadata_source":"pith","pith_arxiv_id":"2507.17746","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Rubrics as Rewards: Reinforcement Learning Beyond Verifiable Domains","venue":"cs.LG","work_id":"805a846c-dae9-4375-abd8-a86dc6934496","year":2025},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2507.17746","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:a73990f2588a9b88acfb197054a54ff29c0603fe61573fcea693d65ef0fe628b","observation_id":"be25c1d3-fc9a-4a65-aa86-687ff91db3e9","resolution":{"observed_at":"2026-05-16T12:30:53.898939Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T21:53:02.879284+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T21:53:02.879284+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13919","last_updated":"2024-06-06T18:37:34Z","snapshot_observed_at":"2026-07-06T17:20:11.913242Z","submitted_at":"2024-01-25T03:33:18Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","version":4},"cited_work":{"arxiv_id":"2401.13919","doi":"10.48550/arxiv.2401.13919","metadata_source":"pith","pith_arxiv_id":"2401.13919","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"WebVoyager: Building an End-to-End Web Agent with Large Multimodal Models","venue":"cs.CL","work_id":"12c1d840-af20-4a4e-8750-6b9c6266638f","year":2024},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2401.13919","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:3ddefb4cf3c5eab38fabe01ed611e13d400cacddfa21d46890c36a036f59a91d","observation_id":"026dae31-73ab-495c-945c-42a9fff7faef","resolution":{"observed_at":"2026-05-16T12:30:53.881950Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01623","last_updated":"2024-06-01T00:32:26Z","snapshot_observed_at":"2026-07-06T18:24:38.958815Z","submitted_at":"2024-06-01T00:32:26Z","title":"WebSuite: Systematically Evaluating Why Web Agents Fail","version":1},"cited_work":{"arxiv_id":"2406.01623","doi":"10.48550/arxiv.2406.01623","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01623","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Li and J","venue":null,"work_id":"861a2b7b-97ec-4ccf-906d-69bcc02532df","year":2024},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2406.01623","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:04b8d5d5c9d3438208592e44fa275bb2a64b6460dee88d1f1d8dcbbf76ce5e8b","observation_id":"a8ef525d-b8c8-46fd-8b57-92e6c755c1ae","resolution":{"observed_at":"2026-05-16T12:30:53.902823Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.01623","last_updated":"2024-06-01T00:32:26Z","snapshot_observed_at":"2026-07-06T18:24:38.958815Z","submitted_at":"2024-06-01T00:32:26Z","title":"WebSuite: Systematically Evaluating Why Web Agents Fail","version":1},"cited_work":{"arxiv_id":"2406.01623","doi":"10.48550/arxiv.2406.01623","metadata_source":"arxiv_reference","pith_arxiv_id":"2406.01623","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Li and J","venue":null,"work_id":"861a2b7b-97ec-4ccf-906d-69bcc02532df","year":2024},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2406.01623","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:59a4173e96829f8ed751fbb92ebc37ebcbc09eb424fdf7fd0934f7153732af07","observation_id":"b90de6d2-0ee8-41f7-8d01-98fe6dd19626","resolution":{"observed_at":"2026-05-16T12:30:53.786370Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02592","last_updated":"2025-07-03T12:59:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-03T12:59:07Z","title":"WebSailor: Navigating Super-human Reasoning for Web Agent","version":1},"cited_work":{"arxiv_id":"2507.02592","doi":"10.48550/arxiv.2507.02592","metadata_source":"pith","pith_arxiv_id":"2507.02592","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"WebSailor: Navigating Super-human Reasoning for Web Agent","venue":"cs.CL","work_id":"fec5a195-1dd5-425a-b552-109af948a7dd","year":2025},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2507.02592","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:746d258f7b0298a270003dfc4a7a998a46a0b99ad061ed90a532eb83da75a135","observation_id":"27b55389-9037-44f3-8b5c-0034a8739e23","resolution":{"observed_at":"2026-05-17T15:37:09.773663Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.08942","doi":"10.48550/arxiv.2504.08942","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Agentrewardbench: Evaluating automatic evaluations of web agent trajectories","venue":null,"work_id":"4672f8c4-b6e4-4226-91be-6e4cb99e2669","year":2025},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:5c78aaa83b0003189f0c23b868579ed5bed962370e0f143c3fd3b762c5a2258d","observation_id":"0a67d5ae-d413-403d-894d-6673788b514a","resolution":{"observed_at":"2026-05-16T12:30:53.891278Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06474","last_updated":"2024-10-07T14:19:37Z","snapshot_observed_at":"2026-08-03T07:29:21.763809Z","submitted_at":"2024-04-09T17:25:47Z","title":"Autonomous Evaluation and Refinement of Digital Agents","version":3},"cited_work":{"arxiv_id":"2404.06474","doi":"10.48550/arxiv.2404.06474","metadata_source":"pith","pith_arxiv_id":"2404.06474","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Autonomous evaluation and refinement of digital agents","venue":"cs.AI","work_id":"dbebca6b-661a-477f-8531-779b4221ac8b","year":2024},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2404.06474","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:b731624d6dbac4a0b70990b70aff9ec738b5f4be8ee4ffe07a678836c9ce4989","observation_id":"90cb41df-f7d5-42c5-be03-73a1f6f0d849","resolution":{"observed_at":"2026-05-16T12:30:53.849781Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":"2408.03314","doi":"10.18653/v1/2025.acl-long.1486","metadata_source":"pith","pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","venue":"cs.LG","work_id":"a8d50b24-bdf5-46ed-bc4f-2927dfd81f1d","year":2024},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:c864fe33f59329954872953f17825c4d77b64d1b84e9518c859226870e36c061","observation_id":"13226e46-a925-406b-81a8-b4fe06df8540","resolution":{"observed_at":"2026-05-16T12:30:53.906553Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19504","last_updated":"2025-08-27T01:29:46Z","snapshot_observed_at":"2026-07-06T22:19:14.155788Z","submitted_at":"2025-08-27T01:29:46Z","title":"Aegis: Taxonomy and Optimizations for Overcoming Agent-Environment Failures in LLM Agents","version":1},"cited_work":{"arxiv_id":"2508.19504","doi":"10.48550/arxiv.2508.19504","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19504","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Aegis: Taxonomy and optimizations for overcoming agent-environment failures in llm agents.arXiv preprint arXiv:2508.19504","venue":null,"work_id":"d4e7a45d-2b1f-4612-800d-3dd4974ba922","year":null},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2508.19504","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:e492c1c46a62fcc48474391dfe0f6d8cbd7e6af3ccf228711e015fc555a3d74f","observation_id":"5fc8b545-4daa-4caf-9018-d1ad5b35e4dd","resolution":{"observed_at":"2026-05-16T12:30:53.870904Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19504","last_updated":"2025-08-27T01:29:46Z","snapshot_observed_at":"2026-07-06T22:19:14.155788Z","submitted_at":"2025-08-27T01:29:46Z","title":"Aegis: Taxonomy and Optimizations for Overcoming Agent-Environment Failures in LLM Agents","version":1},"cited_work":{"arxiv_id":"2508.19504","doi":"10.48550/arxiv.2508.19504","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.19504","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Aegis: Taxonomy and optimizations for overcoming agent-environment failures in llm agents.arXiv preprint arXiv:2508.19504","venue":null,"work_id":"d4e7a45d-2b1f-4612-800d-3dd4974ba922","year":null},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2508.19504","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:7c0896690ca872699738bf66c6a86ae5e8c4d4d5a7ffed10181449dfa5ab3afa","observation_id":"d7d99522-aeb0-4016-b5c3-b86392a3243b","resolution":{"observed_at":"2026-05-16T12:30:53.791034Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.15061","last_updated":"2025-07-20T17:53:37Z","snapshot_observed_at":"2026-07-06T21:59:59.698990Z","submitted_at":"2025-07-20T17:53:37Z","title":"WebShaper: Agentically Data Synthesizing via Information-Seeking Formalization","version":1},"cited_work":{"arxiv_id":"2507.15061","doi":"10.48550/arxiv.2507.15061","metadata_source":"arxiv_reference","pith_arxiv_id":"2507.15061","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Webshaper: Agentically datasynthesizingviainformation-seekingformalization.arXivpreprint","venue":null,"work_id":"ed437781-612e-405b-916f-243b6f4d1443","year":2025},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2507.15061","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:29c0612419983bfc6add8ed5d2a7d60a62fa9a4702f0b5b9d90b95015d5789b9","observation_id":"83764175-b33f-4820-a6c4-22956ca5265d","resolution":{"observed_at":"2026-05-16T12:30:53.879074Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12516","last_updated":"2025-04-16T22:27:45Z","snapshot_observed_at":"2026-08-03T00:43:33.338074Z","submitted_at":"2025-04-16T22:27:45Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","version":1},"cited_work":{"arxiv_id":"2504.12516","doi":"10.48550/arxiv.2504.12516","metadata_source":"pith","pith_arxiv_id":"2504.12516","snapshot_observed_at":"2026-07-11T03:27:46.323996Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","venue":"cs.CL","work_id":"25adb508-d97c-49d6-ae43-7a70c2478a34","year":2025},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2504.12516","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:309fd49c6f8b6ebd143003f7d18bdddbbf3d0595b0e9ce5e98f0b3c97f3d9849","observation_id":"b885cc4b-c826-4328-8b02-ac9eea9dfe58","resolution":{"observed_at":"2026-05-16T12:30:53.895063Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07496","last_updated":"2024-06-11T17:32:21Z","snapshot_observed_at":"2026-07-06T18:29:04.294349Z","submitted_at":"2024-06-11T17:32:21Z","title":"TextGrad: Automatic \"Differentiation\" via Text","version":1},"cited_work":{"arxiv_id":"2406.07496","doi":"10.48550/arxiv.2406.07496","metadata_source":"pith","pith_arxiv_id":"2406.07496","snapshot_observed_at":"2026-07-10T19:07:35.251943Z","title":"TextGrad: Automatic \"Differentiation\" via Text","venue":"cs.CL","work_id":"c52b4841-a4b4-4b4e-bc86-8ef6645a9bbb","year":2024},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2406.07496","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:0547ce31501597fe4ed51475aa9b6c811844dffc8910f42a0cc4fb8f695e3534","observation_id":"a9769eec-10b3-4eef-b38c-56cc115b91e1","resolution":{"observed_at":"2026-05-16T12:30:53.864528Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:25.209279+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:25.209279+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.01948","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"How far are we from genuinely useful deep research agents?arXiv preprint arXiv:2512.01948, 2025a","venue":null,"work_id":"0f46f12b-4ca2-4569-b0a7-277aab96ccb9","year":2025},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:57ae1ae93145e8483a76bb7f2cda5365e685e4eadf2fc6089575970da3f0079f","observation_id":"ee259c2e-f85b-4828-af71-34fc4bfc00c2","resolution":{"observed_at":"2026-05-16T12:30:53.873857Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.14987","last_updated":"2022-03-28T18:00:51Z","snapshot_observed_at":"2026-07-06T12:53:50.496350Z","submitted_at":"2022-03-28T18:00:51Z","title":"Multilingual Knowledge Graph Completion with Self-Supervised Adaptive Graph Alignment","version":1},"cited_work":{"arxiv_id":"2203.14987","doi":"10.48550/arxiv","metadata_source":"doi_reference","pith_arxiv_id":"2203.14987","snapshot_observed_at":"2026-07-09T21:46:34.506658Z","title":"Dickerson","venue":"cs.AI","work_id":"5c2060c6-427c-4321-be22-49ccae439d80","year":2025},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2203.14987","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:d5868ecd1d5f73734804910707c025a1b277cef42b0012f92c91a1344c3b0ad0","observation_id":"034f1ad8-b452-4d29-a483-52e8d4704339","resolution":{"observed_at":"2026-05-16T12:30:53.796093Z","resolver_source":"doi_truncated","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10934","last_updated":"2024-10-16T17:54:12Z","snapshot_observed_at":"2026-08-03T13:34:04.465018Z","submitted_at":"2024-10-14T17:57:02Z","title":"Agent-as-a-Judge: Evaluate Agents with Agents","version":2},"cited_work":{"arxiv_id":"2410.10934","doi":null,"metadata_source":"pith","pith_arxiv_id":"2410.10934","snapshot_observed_at":"2026-07-10T15:07:19.644728Z","title":"arXiv preprint 2410.10934","venue":"cs.AI","work_id":"2e127924-0ccf-418b-9de5-0daa4fb9ad9b","year":2024},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2410.10934","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:f085cf3458e7b3c7cf57163746a2f0c5e956bb9d3608697669b99596f35a8d30","observation_id":"692c93f6-dd87-4ead-8762-64128bc144a2","resolution":{"observed_at":"2026-05-16T12:30:53.885575Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16084","last_updated":"2025-06-30T15:59:26Z","snapshot_observed_at":"2026-07-06T21:13:13.686703Z","submitted_at":"2025-04-22T17:59:56Z","title":"TTRL: Test-Time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2504.16084","doi":"10.48550/arxiv.2504.16084","metadata_source":"pith","pith_arxiv_id":"2504.16084","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"TTRL: Test-Time Reinforcement Learning","venue":"cs.CL","work_id":"54ef1983-e8f7-4b17-9b74-6155b56c8b00","year":2025},"citing_paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T12:29:06.229857Z"},"links":{"cited_paper":"/paper/2504.16084","citing_paper":"/paper/2601.15808"},"observation_digest":"sha256:3361b6c2f6b0c5240961aa30ee75552a214c178d8fa9766f582746083b1d43ac","observation_id":"a4a8d047-23bb-449f-89f3-51f18f922c05","resolution":{"observed_at":"2026-05-16T12:30:53.780583Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2601.15808","last_updated":"2026-04-29T08:40:46Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T22:42:43.581560Z","submitted_at":"2026-01-22T09:47:31Z","title":"Inference-Time Scaling of Verification: Self-Evolving Deep Research Agents via Test-Time Rubric-Guided Verification"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":1,"metadata_mismatch":8,"parse_uncertain":0,"unresolved":0,"verified_exact":12,"verified_fuzzy":1},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 3 inbound Pith citation observations for arXiv:2601.15808."}