{"as_of":"2026-08-06T03:02:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:253a0ac4273da2cac044cdd4a8fdb0463d35779bf22a63ab4b44cdab1d9a2696","coverage":[{"denominator":61,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":61,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T07:42:24.148398Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T15:12:55.638767Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-03T10:27:56.503592Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"cited_work":{"arxiv_id":"2605.16217","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.16217","snapshot_observed_at":"2026-07-03T10:27:56.503592Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","venue":"cs.CL","work_id":"f73c7f92-4f01-4754-b282-fed125063f2e","year":2026},"citing_paper":{"arxiv_id":"2606.12087","last_updated":"2026-06-10T13:49:11Z","snapshot_observed_at":"2026-08-02T15:03:50.335992Z","submitted_at":"2026-06-10T13:49:11Z","title":"FORT-Searcher: Synthesizing Shortcut-Resistant Search Tasks for Training Deep Search Agents","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-06-27T10:01:45.332920Z"},"links":{"cited_paper":"/paper/2605.16217","citing_paper":"/paper/2606.12087"},"observation_digest":"sha256:4a9ef12e32b8cc19a3e986d38c382e5e9adb3c6c720bf1bd0d9cf3a17d91f0c6","observation_id":"311b105f-6274-4041-86de-82c1eb115d6e","resolution":{"observed_at":"2026-07-03T10:27:56.504990Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.16217","snapshot_observed_at":"2026-08-04T15:12:55.638767Z","title":"2026 , archivePrefix =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.02097","last_updated":"2026-08-03T11:58:21Z","snapshot_observed_at":"2026-08-06T02:24:58.792621Z","submitted_at":"2026-08-03T11:58:21Z","title":"Fetch-then-Explore: Decoupling Selection from Extraction over a Persistent Workspace for Search Agents","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-04T15:12:55.638767Z"},"links":{"cited_paper":"/paper/2605.16217","citing_paper":"/paper/2608.02097"},"observation_digest":"sha256:fdbd54ced3ad17a59253971b5e20a944a4a8e2754a90f8570f7515ae9e7aae20","observation_id":"89c03f4b-e1f6-481c-ad44-a34be4563e1a","resolution":{"observed_at":"2026-08-04T15:12:55.638767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2605.16217/citation-record","integrity":"/paper/2605.16217/integrity","json":"/paper/2605.16217/citation-record.json","paper":"/paper/2605.16217"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep research system card","venue":null,"work_id":"0d67adc7-853c-4932-a027-fa9ebdd84c04","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:3f64b2d80f8ed8e32195d0eea5b64e7514e1eff70950ac30484baf55c9eae775","observation_id":"ddccb505-bcea-486e-a1d0-66a6f8d29359","resolution":{"observed_at":"2026-05-21T07:44:03.514844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gemini deep research overview","venue":null,"work_id":"511ead80-3346-4f66-9b03-246974f6a4e8","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:ed785400abad9e3f9529cd737556633adf6be20bd69ffd3c301b63762ba46aa6","observation_id":"1f46dbf5-91e8-44b0-bbf0-7d8f869e09f6","resolution":{"observed_at":"2026-05-21T07:44:03.511167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grok 3 beta — the age of reasoning agents, February 2025","venue":null,"work_id":"016197a1-40e2-47be-95e2-5e1428f97b82","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:2fa0f2b12c9b317cc5749c5615eb9fd8ea53114f6d3d90e86a063c966dab0482","observation_id":"51a7e0f4-8781-4d5e-bcfc-3a2f9d8e48cc","resolution":{"observed_at":"2026-05-21T07:44:03.513875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.24701","last_updated":"2026-05-18T04:10:32Z","snapshot_observed_at":"2026-07-06T22:34:18.297603Z","submitted_at":"2025-10-28T17:53:02Z","title":"Tongyi DeepResearch Technical Report","version":3},"cited_work":{"arxiv_id":"2510.24701","doi":"10.48550/arxiv.2510.24701","metadata_source":"pith","pith_arxiv_id":"2510.24701","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Tongyi DeepResearch Technical Report","venue":"cs.CL","work_id":"1c8db01b-b50f-4711-b181-a04bcc3e9aa8","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2510.24701","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:6f4b20a0bc581f32daefb73949fe5057906fd1a0d9ce168aa1591e5f0b2fd106","observation_id":"c58ece30-626e-4bd1-8ffb-15012922fea7","resolution":{"observed_at":"2026-05-21T07:44:02.996765Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T07:46:03.944597Z","title":"Chi, Sharan Narang, Aakanksha Chowdhery, and Denny Zhou","venue":null,"work_id":"ec8e8f74-3866-40a3-821f-1ce5afcf7a80","year":2023},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:1948cdfbe4fb1d0ef51e1525b6aa030f239475024afd69f9e525fdae8168399e","observation_id":"b5b64e5a-b88e-494f-8b15-e3cdf9fac97b","resolution":{"observed_at":"2026-05-21T07:44:03.516843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.14275","last_updated":"2022-11-25T18:19:44Z","snapshot_observed_at":"2026-08-01T02:16:43.109337Z","submitted_at":"2022-11-25T18:19:44Z","title":"Solving math word problems with process- and outcome-based feedback","version":1},"cited_work":{"arxiv_id":"2211.14275","doi":"10.2196/53233","metadata_source":"pith","pith_arxiv_id":"2211.14275","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Solving math word problems with process- and outcome-based feedback","venue":"cs.LG","work_id":"94492239-b1d5-435e-bea5-7f51992d0614","year":2022},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2211.14275","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:f37a333b783348ecf69495c051ad274b7d95841774a6e0497ce8d767a5f90b1a","observation_id":"96247f7a-d230-413f-aa8a-0f3fbc8b7e4f","resolution":{"observed_at":"2026-05-21T07:44:02.984606Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.14168","last_updated":"2021-11-18T00:23:45Z","snapshot_observed_at":"2026-08-04T15:46:25.710484Z","submitted_at":"2021-10-27T04:49:45Z","title":"Training Verifiers to Solve Math Word Problems","version":2},"cited_work":{"arxiv_id":"2110.14168","doi":"10.1002/j.1545-","metadata_source":"pith","pith_arxiv_id":"2110.14168","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Training Verifiers to Solve Math Word Problems","venue":"cs.LG","work_id":"acab1aa8-b4d6-40e0-a3ee-25341701dca2","year":2021},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2110.14168","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:1971e3afc3fa13b0c02c23575f1fe0b61b807b679f9b8b250caab021d13394b8","observation_id":"a3fee959-b4d9-4ca0-aa09-35c3daee9fde","resolution":{"observed_at":"2026-05-21T07:44:03.001917Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Scaling LLM test- time compute optimally can be more effective than scaling parameters for reasoning","venue":null,"work_id":"ce045b3f-8d29-49bb-9c87-466962a17737","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:d29074667f3ee61320aed28d87cb2dfd43b9dcb3c3c53a91635229ebfea1aa01","observation_id":"f68b1eaf-3b8c-47f8-a9bc-a7ec8f3ebba9","resolution":{"observed_at":"2026-05-21T07:44:03.501882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.24698","doi":"10.48550/arxiv.2510.24698","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Parallelmuse: Agentic parallel thinking for deep information seeking","venue":"arXiv (Cornell University)","work_id":"44c10dc9-4edf-4d71-8a81-23017162c6ae","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:8002a7fd037ec2cff4219fecfa1dd9c763e859b6beed0f36781b4d1f73e9e26b","observation_id":"0680f725-0cf4-4124-8ebb-103251c1466d","resolution":{"observed_at":"2026-05-21T07:44:02.995105Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.05593","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T18:17:33.691944Z","title":"Pacore: Learning to scale test-time compute with parallel coordinated reasoning","venue":null,"work_id":"15a0547d-95fd-4981-a7fb-76fc0718a143","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:99c84f5588b95ebeb42bb763d3e53a64187d8d5ce2025541e66d0f57e021d2a4","observation_id":"bcd8915b-59ef-4aab-8aa1-58e4392cfa9d","resolution":{"observed_at":"2026-05-21T07:44:03.000874Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:4dfb1dac508ade61c0a2e07ee94d9d114673cdd9ff1c79159d163adaa19ea8a1","observation_id":"1b6f6892-e418-4ab9-b6d7-0086ebfc758e","resolution":{"observed_at":"2026-05-21T07:44:02.979309Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.11753","last_updated":"2026-04-13T17:26:31Z","snapshot_observed_at":"2026-07-06T23:00:03.762376Z","submitted_at":"2026-04-13T17:26:31Z","title":"Agentic Aggregation for Parallel Scaling of Long-Horizon Agentic Tasks","version":1},"cited_work":{"arxiv_id":"2604.11753","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.11753","snapshot_observed_at":"2026-07-03T17:48:46.292934Z","title":"Agentic Aggregation for Parallel Scaling of Long-Horizon Agentic Tasks","venue":"cs.CL","work_id":"9b76b989-ea2b-43c9-a750-fdb5500cdde7","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2604.11753","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:137791b52c96eaea9886c21b3de723f1ddf6874ddfa95c620e872b5d52236346","observation_id":"ccea9425-2bae-4270-b4c9-beade12f4291","resolution":{"observed_at":"2026-05-21T07:44:02.974228Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Pushing test-time scaling limits of deep search with asymmetric verification","venue":null,"work_id":"087ae3e8-9948-4360-a12b-5c58b0b821b1","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:982830ee92ef239c92c991942b188315f9cb5dfae95020265688ca6e2f6d69a1","observation_id":"2aee5311-7288-451c-ab14-29a3067a5154","resolution":{"observed_at":"2026-05-21T07:44:03.495749Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":"2602.02276","doi":"10.48550/arxiv.2602.02276","metadata_source":"pith","pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi K2.5: Visual Agentic Intelligence","venue":"cs.CL","work_id":"d690be8f-5d53-49b0-b1e7-79668eb8fcdb","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:605fc11a30ca40540c4f763285a8c2795e664d0895de09ec64cf8cd79f6d9f4f","observation_id":"d4347ff9-d16b-4e14-824f-a7d3667d8a2f","resolution":{"observed_at":"2026-05-21T07:44:02.966521Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"React: Synergizing reasoning and acting in language models","venue":null,"work_id":"c48ce6e8-7a3a-4360-8d33-c30d1793de10","year":2022},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:e542aa63d03b3f75d4792c1a8252bc72e91151e77658a50d7050220015fb2b9f","observation_id":"62e5c425-ab45-44b6-9a38-c9a4ab99bda9","resolution":{"observed_at":"2026-05-21T07:44:03.497833Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":"2112.09332","doi":"10.48550/arxiv.2112.09332","metadata_source":"pith","pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebGPT: Browser-assisted question-answering with human feedback","venue":"cs.CL","work_id":"e25ef3e1-4848-4cb9-bf28-67a420591165","year":2021},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:12f3823adbf1b7bd6c64177f70bc347ec09aa890800efdd9fb023a48123f1d22","observation_id":"efff23de-5837-46f9-b8f5-c53067569a3f","resolution":{"observed_at":"2026-05-21T07:44:02.968870Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:09.995583+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13854","last_updated":"2024-04-16T15:13:18Z","snapshot_observed_at":"2026-07-06T15:58:31.756298Z","submitted_at":"2023-07-25T22:59:32Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","version":4},"cited_work":{"arxiv_id":"2307.13854","doi":"10.48550/arxiv.2307.13854","metadata_source":"pith","pith_arxiv_id":"2307.13854","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebArena: A Realistic Web Environment for Building Autonomous Agents","venue":"cs.AI","work_id":"7058ffd2-a339-4102-89eb-248eeb074652","year":2023},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2307.13854","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:3453b19d943ffe674f5c46afbd2bb06087b6d1c8d418750ea3a3649d069dd16b","observation_id":"0295f978-fd4a-4f89-b62f-e62af186befa","resolution":{"observed_at":"2026-05-21T07:44:02.976746Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T18:52:18.85917+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2025.emnlp-main.276","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Search-o1: Agentic search-enhanced large reasoning models","venue":null,"work_id":"ce43fcba-d6af-4bbd-875f-23f69db94928","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:8c4f647dc00c4d87f47d1e060830a47f66473032b8c9bbd4a822385351a4b836","observation_id":"d3bde5d2-2614-421f-be6c-a6fd268ae7cf","resolution":{"observed_at":"2026-05-21T07:44:02.581431Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T19:49:49.321553+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T19:49:49.321553+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-07T15:13:54.676757Z","title":"Tree of thoughts: Deliberate problem solving with large language models.Ad- vances in neural information processing systems, 36:11809–11822","venue":null,"work_id":"a6744ae4-8f0e-4304-a9db-84910eaa073a","year":2023},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:f396d5e9aaa312dbbd6b02fb10784c45e981fc9ce16589e5d0ef1fdc6b8a2640","observation_id":"8d5de88c-9de3-462b-b5ff-cfae606c6de4","resolution":{"observed_at":"2026-05-21T07:44:03.493885Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16130","last_updated":"2025-02-19T10:49:41Z","snapshot_observed_at":"2026-07-06T18:05:11.700127Z","submitted_at":"2024-04-24T18:38:11Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","version":2},"cited_work":{"arxiv_id":"2404.16130","doi":"10.48550/arxiv.2404.16130","metadata_source":"pith","pith_arxiv_id":"2404.16130","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"From Local to Global: A Graph RAG Approach to Query-Focused Summarization","venue":"cs.CL","work_id":"588618d7-fd41-4053-b34d-a981f8793039","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2404.16130","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:b2b0e5fbfdc22d830bc0409f3f92b25bd991003a83e213c3699ceaeff2f7abc4","observation_id":"396942f9-2730-4238-b728-275aee7bb8e1","resolution":{"observed_at":"2026-05-21T07:44:02.999447Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T05:49:57.694079+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T05:49:57.694079+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"HippoRAG: Neurobiologically inspired long-term memory for large language models","venue":null,"work_id":"c44fcae2-3c48-4c9c-8441-2b0cd523e5d2","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:4cf3b9ff92cb0e541bdac4ff3b6f1463f9615bd2b0b402b3ba8cf489f55f6042","observation_id":"076f72f3-4f2f-4f77-9e14-7d85bdab524d","resolution":{"observed_at":"2026-05-21T07:44:03.517763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.741","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:37:06.726417Z","title":"Proceedings of the 2023","venue":"Proceedings of the 2023 Conference on Empirical Methods in Natural Language Processing","work_id":"f952e39f-7d85-4a4f-9dd7-9da09cf2c1d8","year":2023},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:22909adddf0efac24fe13edca6dd112497dba8e66afd101cad4bc25aa8c7a083","observation_id":"f64475e5-1974-4269-8e6c-2981f4f993ef","resolution":{"observed_at":"2026-05-21T07:44:02.583596Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T21:20:13.984389+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T21:20:13.984389+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Long-form factuality in large language models","venue":null,"work_id":"3aedc1dc-52a6-4af2-a08d-e25529409504","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:4949552b4d6307b261dc5ec7a0425a7a6aed6b6818205a88d14cd4686a1c7ac9","observation_id":"e23596dd-ab94-4d4b-aa72-44634b34935b","resolution":{"observed_at":"2026-05-21T07:44:03.510166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Factool: Factuality detection in generative AI - a tool augmented framework for multi-task and multi-domain scenarios","venue":null,"work_id":"c31d0af7-eadd-47e1-910f-b218d19923fa","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:ed449fb2e51838caee6ad47c8396e6744443e041d989dbbfbad930cbe33b0ef2","observation_id":"b22578d2-0d39-4c39-9c7d-fcbaff1055cf","resolution":{"observed_at":"2026-05-21T07:44:03.502571Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.findings-acl.212","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chain-of-verification reduces hallucination in large language models","venue":null,"work_id":"91048824-e8a8-42af-8ce2-8b22a900653f","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:9087bc635d5f810f3333ddffdeb1f4dc9b381091d61456b0bff35e1d367fa86a","observation_id":"d0b63fdc-303f-4a97-917f-79d15878e17c","resolution":{"observed_at":"2026-05-21T07:44:02.585449Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":"59502c54-af8d-4e5d-bcc8-7f1ef71d800a","year":2023},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:06cc0336aeb24233b56ee0b50fd4cbed1d096ac15dc979ac05b4a925ff9c86bd","observation_id":"2df6a5d6-ca6f-4c96-afcb-d26c962fb6ae","resolution":{"observed_at":"2026-05-21T07:44:03.496736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Smith, and Mike Lewis","venue":null,"work_id":"16d89dae-df67-4eeb-8fd1-63a021e6395f","year":2023},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:cfb1a0d275a6c5d86c4935255e3e374aaf7a9643e526f4e5ed6a933873c08d0f","observation_id":"34b6abc9-2125-4d0a-a50e-58329cb2e788","resolution":{"observed_at":"2026-05-21T07:44:03.503454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T10:04:52.365581Z","title":"Qwen3.5: Accelerating productivity with native multimodal agents, February","venue":null,"work_id":"f37dcb7f-3329-4b47-b2b7-85458b1592d1","year":null},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:56bbf3e2a12f9f14cadfd7afab1852237eb91c5bf54d2c255acbc8a14699f8fd","observation_id":"dada0eba-80ef-4c3e-b30d-5c10cc3931f3","resolution":{"observed_at":"2026-05-21T07:44:03.500688Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T10:04:52.368885Z","title":null,"venue":null,"work_id":"c39e4053-229e-4a4c-8726-7c6ff6b49736","year":null},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:1504a25b36bba23f4deb4d12526776e39b656b32ed9ce7e107b2870d8a748898","observation_id":"63c054b6-58b9-4b87-8832-f3fa34055b89","resolution":{"observed_at":"2026-05-21T07:44:03.506651Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.02592","last_updated":"2025-07-03T12:59:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-03T12:59:07Z","title":"WebSailor: Navigating Super-human Reasoning for Web Agent","version":1},"cited_work":{"arxiv_id":"2507.02592","doi":"10.48550/arxiv.2507.02592","metadata_source":"pith","pith_arxiv_id":"2507.02592","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WebSailor: Navigating Super-human Reasoning for Web Agent","venue":"cs.CL","work_id":"fec5a195-1dd5-425a-b552-109af948a7dd","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2507.02592","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:9f0db5a89a1c88b9c3cd8fd3c658d01d38aa2a6e7525f15f60c5964fd35d6800","observation_id":"3d5ec2d4-32b2-4659-867d-594a59658c69","resolution":{"observed_at":"2026-05-21T07:44:02.984785Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Websailor-v2: Bridging the chasm to proprietary agents via synthetic data and scalable rein- forcement learning","venue":null,"work_id":"4c0c35fa-9465-40d7-b4be-da2f44ef51a0","year":null},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:b5f6999a16fae4474f50a251e06345e313bf1d8d8a120d9972db67b26507ecc7","observation_id":"ff28d426-7119-4b8c-81c5-e13682c23ad5","resolution":{"observed_at":"2026-05-21T07:44:03.504478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0ab7dd7f-efa2-452e-b4b3-73a794677957","year":null},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:24564f82dd9f5fbd77ff6e61d7d5530a21fe336d275b2f54adfe748fb34cd9a9","observation_id":"3642fd2b-57ac-4ba8-93a5-cbea2486c4cd","resolution":{"observed_at":"2026-05-21T07:44:03.508400Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:6c3db6bded00d2cd4ab8b9ab827669243d575833190bf1e4c605be0485cc0b74","observation_id":"a3a9724c-8a20-4af4-896e-b3c5e2b77718","resolution":{"observed_at":"2026-05-21T07:44:02.989697Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Let’s verify step by step","venue":null,"work_id":"1f276082-101a-44af-83a3-51502a083245","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:5d9e25a1714c362e953a3d4d2b249ecbf279abccf158ae4955e69f953c953fc6","observation_id":"24f64367-2593-48ee-95ca-fb2370d173b3","resolution":{"observed_at":"2026-05-21T07:44:03.462767Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Browsecomp: A simple yet challenging benchmark for browsing agents","venue":null,"work_id":"fecf8df9-9367-4666-ab3c-93d5b3e475ba","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:c7b6e790cb5d0bf4bb937f30e6ec49228bd2404b0c804f788d85271a0283dd5d","observation_id":"912de9f3-ac6c-42ac-a851-b1f89cf5dd8d","resolution":{"observed_at":"2026-05-21T07:44:03.467116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19314","last_updated":"2025-05-01T05:02:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-27T17:32:43Z","title":"BrowseComp-ZH: Benchmarking Web Browsing Ability of Large Language Models in Chinese","version":2},"cited_work":{"arxiv_id":"2504.19314","doi":"10.48550/arxiv.2504.19314","metadata_source":"pith","pith_arxiv_id":"2504.19314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BrowseComp-ZH: Benchmarking Web Browsing Ability of Large Language Models in Chinese","venue":"cs.CL","work_id":"d2997896-a54e-43f5-80ac-d4d548116d21","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2504.19314","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:3b0aed1316da378d2472fd7cbcc5362b5e0a4c84d19f95c5d1a6b60e99091683","observation_id":"0a001d36-5de1-4bf1-8362-c064de1e14be","resolution":{"observed_at":"2026-05-21T07:44:02.992354Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.13651","last_updated":"2025-06-16T16:16:14Z","snapshot_observed_at":"2026-07-06T21:43:03.415527Z","submitted_at":"2025-06-16T16:16:14Z","title":"xbench: Tracking Agents Productivity Scaling with Profession-Aligned Real-World Evaluations","version":1},"cited_work":{"arxiv_id":"2506.13651","doi":"10.48550/arxiv.2506.13651","metadata_source":"pith","pith_arxiv_id":"2506.13651","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"xbench: Tracking agents productivity scaling with profession-aligned real-world evaluations","venue":"cs.LG","work_id":"b7f0bdf6-3821-4735-b55e-be58f6ef326d","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2506.13651","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:47145377ee5f1ef5a2f249f50545f8d41db0493431392b1f9963439e0415dd22","observation_id":"8152d77d-739b-49a0-a8fb-3eb4faefb282","resolution":{"observed_at":"2026-05-21T07:44:02.954738Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gaia: a benchmark for general ai assistants","venue":null,"work_id":"47a8f180-6d0e-4ae7-bf98-d3caaa7ed618","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:c9722681c24279c1be7d82ce590aad5becc977f52af5f9a2b883156ba2cd18e2","observation_id":"2f66c7b8-6d52-41da-a096-b8b75b1a8751","resolution":{"observed_at":"2026-05-21T07:44:03.476823Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01062","last_updated":"2026-04-09T17:44:11Z","snapshot_observed_at":"2026-07-06T21:34:38.683177Z","submitted_at":"2025-06-01T16:04:34Z","title":"SealQA: Raising the Bar for Reasoning in Search-Augmented Language Models","version":4},"cited_work":{"arxiv_id":"2506.01062","doi":"10.48550/arxiv.2506.01062","metadata_source":"pith","pith_arxiv_id":"2506.01062","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"SealQA: Raising the Bar for Reasoning in Search-Augmented Language Models","venue":"cs.CL","work_id":"92de1187-b15f-439e-9005-9178cb024209","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2506.01062","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:ec598e74c8fbd7964816301c889f7c4f39e6c7f497f85f3235b519e841d7a5ad","observation_id":"0b47e39c-92ec-4590-9c47-90f191fbb4b1","resolution":{"observed_at":"2026-05-21T07:44:02.987216Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14249","last_updated":"2026-02-20T04:23:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-24T05:27:46Z","title":"Humanity's Last Exam","version":10},"cited_work":{"arxiv_id":"2501.14249","doi":"10.1038/s41586-025-09962-4","metadata_source":"pith","pith_arxiv_id":"2501.14249","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Humanity's Last Exam","venue":"cs.LG","work_id":"59ea00d4-16a8-45e1-aafc-290a6f91d9f4","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2501.14249","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:625037f0fd41adcedd2bf8cb2377258c0791831d71447202e85dd9c43b5f84f3","observation_id":"38c3bfc5-04db-426f-af04-75c37f12efca","resolution":{"observed_at":"2026-05-21T07:44:02.967776Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T22:08:32.844211+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.21165","doi":"10.48550/arxiv.2601.21165","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Frontierscience: Evaluating ai’s ability to perform expert-level scientific tasks","venue":"Open MIND","work_id":"cb5985eb-b2ed-45b4-9d1d-a9eb8a46a6ca","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:8a1ea7c1d25a581abc7f6b5a0aa48789c611cad9655ca65514b7691ddc5ca223","observation_id":"6cd9e5be-3746-4201-9c8d-7ee7cd1488da","resolution":{"observed_at":"2026-05-21T07:44:02.957444Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Openai gpt-5.2 system card","venue":null,"work_id":"120c672c-fc27-4e1d-81ef-994dcb61258b","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:91ed7496558ea5f58422c97b52c7d852f613987b4d5db83b1faef468473633fc","observation_id":"cc63b825-a71e-4de1-9fd1-8cd97a56d39b","resolution":{"observed_at":"2026-05-21T07:44:03.478931Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"System card claude sonnet 4.6","venue":null,"work_id":"9902c050-db30-4118-84a1-fdab4c56a2b2","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:dddf9aa238b39de9ee1ee1ba87e46f2c2d7874eb2e557b7fdef1a475c8c745b6","observation_id":"3790bb3b-0bd5-470e-9cec-e6534f547d6c","resolution":{"observed_at":"2026-05-21T07:44:03.518813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Seed 2.0 model card: Towards intelligence frontier for real-world complex- ity","venue":null,"work_id":"5373447e-e565-424c-81a9-11f927797135","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:fe3e9545052662a00ef364035fe6c29c063062e5ffa20cbe999a75420580dc9e","observation_id":"ad4b786c-209a-4d2b-ad4d-fe84e76deecc","resolution":{"observed_at":"2026-05-21T07:44:03.519536Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":"2602.15763","doi":"10.48550/arxiv.2602.15763","metadata_source":"pith","pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","venue":"cs.LG","work_id":"ad29b1a2-bf77-46b3-9ead-fb62b1d2c6fe","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:f0a45ac8826b9b85700f52a57afe1fa4a354b39b39758e647b8fb44dd284bdad","observation_id":"04f46956-9333-4efd-974c-819231ef7188","resolution":{"observed_at":"2026-05-21T07:44:02.990465Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kimi k2.6 technical blog","venue":null,"work_id":"24aeebfa-62e9-4f84-99be-8184cc66745c","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:cfc2dfb3a9ea25c73a53d403dd9d5085e0c1b4423e90699a83dde7e909287495","observation_id":"0131f8fa-d5d8-408b-a8fd-794284dba6c5","resolution":{"observed_at":"2026-05-21T07:44:03.509466Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deepseek v4 technical report","venue":null,"work_id":"68ed0d24-fce8-4c26-ba08-4648e812bb1f","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:0f374ce595f70f83dc3e8ba5aae476787012dd2ff0d1ad29507389aeffca3f95","observation_id":"068f88bb-667e-4e7f-8622-4dd788a178d1","resolution":{"observed_at":"2026-05-21T07:44:03.507664Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.15726","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T10:27:56.457631Z","title":"Mirothinker-1.7 & h1: Towards heavy-duty research agents via verification","venue":null,"work_id":"fb535f2a-eeb1-4b72-9ed3-24c9a3141f44","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:2d1cee3e422bf6c74c8059d38703fe1a47c517e9a0cc5bded8f491a666ea1e7d","observation_id":"c2d8655b-620a-4c0a-9d9b-2bed65b3221d","resolution":{"observed_at":"2026-05-21T07:44:02.993512Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Webwalker: Benchmarking llms in web traversal","venue":null,"work_id":"6ec4e099-cc8b-48fa-8bcb-3a84cae70ba9","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:03befc087a4e2a4d94a0ed60147ae861ab313c5a37b0811b7834172c2ca8d8db","observation_id":"45abff22-77a5-4679-bc64-162e8b5bc5d0","resolution":{"observed_at":"2026-05-21T07:44:03.520505Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Webthinker: Empowering large reasoning models with deep research capability.Advances in Neural Information Processing Systems, 38:120091–120131","venue":null,"work_id":"e251c32f-322c-41b6-b2c9-525ac425d15b","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:dab420e1d2ba5c9d226bb32ec09ce510be9715c2381c1831fa69a938f6490a10","observation_id":"14b8fda9-f299-4fb8-831a-0ebce0b12acd","resolution":{"observed_at":"2026-05-21T07:44:03.484961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Webdancer: Towards autonomous information seeking agency","venue":null,"work_id":"aed230d0-38d0-4c6d-8ae9-402a7f751beb","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:b465dd223ad90bcd3fbd76e1f709df2558ca2af163ba7890a400148dc91d4b0c","observation_id":"cb46b44c-d7f9-4e1b-a956-150fb7d05eea","resolution":{"observed_at":"2026-05-21T07:44:03.487082Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.13309","doi":"10.48550/arxiv.2509.13309","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Webresearcher: Unleashing unbounded reasoning capability in long-horizon agents","venue":"ArXiv.org","work_id":"2a0eb4fc-fe06-4031-8d4b-c3b75f67e486","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:0902a92c519b5af00730754f494793116f28675255dc5cd1641245d483aa432f","observation_id":"448705b1-2dd5-4cd0-b89b-1dcc2df70892","resolution":{"observed_at":"2026-05-21T07:44:03.006667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.06501","doi":"10.48550/arxiv.2509.06501","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Webexplorer: Exploreandevolvefortraininglong-horizonwebagents.arXivpreprint","venue":"arXiv (Cornell University)","work_id":"f67ea6b5-9dbd-417e-bb53-06912e186c85","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:360f19d32b6af536ae8a23107ba63c0f4b1d2e347aefe80baa80e92efa79a507","observation_id":"084a1b7e-90d6-4553-9734-771274e7f5fd","resolution":{"observed_at":"2026-05-21T07:44:02.973443Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.24699","doi":"10.48550/arxiv.2510.24699","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Agentfold: Long-horizon web agents with proactive context management","venue":"arXiv (Cornell University)","work_id":"c066e479-5bdf-45aa-9a32-63dae2dff088","year":2025},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:98c4d9d7653077ed9cc9b53921b963d6f43473e61d89f3b138367ada4688243c","observation_id":"01cc299f-400b-4f14-a22a-4c548091bc61","resolution":{"observed_at":"2026-05-21T07:44:03.003554Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.13313","doi":"10.48550/arxiv.2509.13313","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Resum: Unlocking long-horizon search intelligence via context summarization","venue":"ArXiv.org","work_id":"f9804930-fb00-40fa-8093-298b7c196181","year":2026},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:3c78a450267644428f00fe475eb67011c376827f86bd29c3ff6a373915beeeed","observation_id":"bc8c672c-8fb5-4a4d-afaf-c406d4fe6c79","resolution":{"observed_at":"2026-05-21T07:44:03.012706Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-11T16:19:05.381844+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T16:19:05.381844+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Reasoning with language model is planning with world model","venue":null,"work_id":"2ed032f0-eb05-4262-9ff3-274905124287","year":2023},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:6700688456eb22a561552c9f008e764d770ceea0c9ac962a68cee3b8d4f5cc57","observation_id":"34b4ee54-8306-4b74-94bb-0a4d3a90f241","resolution":{"observed_at":"2026-05-21T07:44:03.480377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Autogen: Enabling next-gen llm applications via multi-agent conversations","venue":null,"work_id":"2d3f547b-48d8-4e37-acd8-cda27202f4d6","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:c8f28b9854bdc3ce2bd2918969012ccf8de5d67280e8b10ef9eabdb9269e8585","observation_id":"f1db5584-7823-4307-b9f3-60d372aa95bb","resolution":{"observed_at":"2026-05-21T07:44:03.482187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Camel: Communicative agents for\" mind\" exploration of large language model society.Advances in neural information processing systems, 36:51991–52008","venue":null,"work_id":"f0e6f682-8c56-41b2-8626-859078781db0","year":2023},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:c0aa7bc2506c1f99e24a592b1f86545417e8801592dd3723722ff4146b85c2c4","observation_id":"538ad60c-832d-4672-81e9-5168dbb2d648","resolution":{"observed_at":"2026-05-21T07:44:03.494956Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Metagpt: Meta programming for a multi-agent collaborative framework","venue":null,"work_id":"2213ecf2-f5b9-459c-a60c-b9cfad6349ab","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:f801c73116a8dab58f1a1f8bfc6caab9ca84751b8c97375c77c2f0bc708a5dc2","observation_id":"62047f19-707d-4b7d-92f7-e279d477585f","resolution":{"observed_at":"2026-05-21T07:44:03.511827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Improving factuality and reasoning in language models through multiagent debate","venue":null,"work_id":"ac8537dd-3227-4296-853b-afec513891c0","year":2024},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:ced58e4bb8b938352c81e64bc2cb6a6ef2e0a72263ac59a83560f6ddae11146a","observation_id":"6e505ae6-5347-4fba-ae41-5bc88a8045a1","resolution":{"observed_at":"2026-05-21T07:44:03.515945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2305.17066","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T06:59:37.226617Z","title":"Mindstorms in natural language-based societies of mind","venue":null,"work_id":"0de80894-4815-468d-b4a8-1966b3457850","year":2023},"citing_paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-21T07:42:24.148398Z"},"links":{"citing_paper":"/paper/2605.16217"},"observation_digest":"sha256:18daaebf66b60f58a6de89dc4143b7957b103842d1bff55599f6c56c2ab35bf5","observation_id":"61d1ba3d-d915-435f-aeaa-94f4b4c66f83","resolution":{"observed_at":"2026-05-21T07:44:03.009596Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.16217","last_updated":"2026-05-20T01:48:19Z","latest_version":3,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:27:24.957966Z","submitted_at":"2026-05-15T17:29:27Z","title":"Argus: Evidence Assembly for Scalable Deep Research Agents"},"reference_resolution":{"displayed":61,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":2,"verified_exact":25,"verified_fuzzy":31},"total_outbound_references":61},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 61 of 61 outbound references and 2 inbound Pith citation observations for arXiv:2605.16217."}