{"as_of":"2026-08-21T08:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8dadf39a042a818515407936a7af09e2e9c7965ad78464349898f39bcb40ef74","coverage":[{"denominator":53,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":53,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-31T00:05:16.958525Z","state":"measured"},{"denominator":53,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":53,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-21T06:32:19.484+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25151/citation-record","integrity":"/paper/2607.25151/integrity","json":"/paper/2607.25151/citation-record.json","paper":"/paper/2607.25151"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.694032Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.694032Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:3897aac343104b1a5245d547156e24b6dd8576dd61b3330c3a4cc82ba92c0101","observation_id":"396979ed-b2b3-4180-b140-944708fd419b","resolution":{"observed_at":"2026-07-31T00:05:16.694032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.700492Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.700492Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:bd49b32b3423c35a9775c74bcf7c5066ba4508e3e44627cd4ba79a5032a7954b","observation_id":"2b084140-bef9-43d1-9c5f-c32384563347","resolution":{"observed_at":"2026-07-31T00:05:16.700492Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.06600","last_updated":"2025-08-08T17:55:11Z","snapshot_observed_at":"2026-08-16T19:56:18.562519Z","submitted_at":"2025-08-08T17:55:11Z","title":"BrowseComp-Plus: A More Fair and Transparent Evaluation Benchmark of Deep-Research Agent","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.06600","snapshot_observed_at":"2026-07-31T00:05:16.710427Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.710427Z"},"links":{"cited_paper":"/paper/2508.06600","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:84e8ac4eff0437371112fab7c2b3a1cbb0bc766c4278128821e896bb6184f73e","observation_id":"77a95877-b863-4800-9ef6-044760d1c7e4","resolution":{"observed_at":"2026-07-31T00:05:16.710427Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11763","last_updated":"2025-06-13T13:17:32Z","snapshot_observed_at":"2026-08-18T17:58:16.707563Z","submitted_at":"2025-06-13T13:17:32Z","title":"DeepResearch Bench: A Comprehensive Benchmark for Deep Research Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11763","snapshot_observed_at":"2026-07-31T00:05:16.717105Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.717105Z"},"links":{"cited_paper":"/paper/2506.11763","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:489a934867be67ec8cbab8290ec4b7e2c97fc58c076847bc06a2b8d446cd4729","observation_id":"ca8ab849-1d20-4e2b-b145-bd4a4c651864","resolution":{"observed_at":"2026-07-31T00:05:16.717105Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.06676","last_updated":"2026-06-20T08:29:36Z","snapshot_observed_at":"2026-08-14T21:38:45.628905Z","submitted_at":"2026-01-10T20:29:12Z","title":"One Interaction Is Worth a Thousand Guesses: Benchmarking the Interactive Capabilities of Deep Research Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.06676","snapshot_observed_at":"2026-07-31T00:05:16.722648Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.722648Z"},"links":{"cited_paper":"/paper/2601.06676","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:4b94a332d991480b62fd92c5c709dd18252239c25202d4c6298473a6c173bd49","observation_id":"207771c4-f0d3-4c31-a136-5a9a0d3ea8a1","resolution":{"observed_at":"2026-07-31T00:05:16.722648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.728286Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.728286Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:ee90c3ce479f8b52fcbcf3aa16647bed1dbda97a191b15cca5753fc93c9a9547","observation_id":"12c1cfae-a267-4ec5-a5bd-d348d57543ec","resolution":{"observed_at":"2026-07-31T00:05:16.728286Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.733888Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.733888Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:da33d8c0a3b05efd04274e489f574d7f292e09021f1af1ef9c60cdeb01a001dd","observation_id":"3a19dedc-449a-431a-8a80-0dbe07d97177","resolution":{"observed_at":"2026-07-31T00:05:16.733888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.739249Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.739249Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:582b7e513a0a7e0c99fbf8c68ab6548ec39480241e6decc987fe9cf70ff450bc","observation_id":"df8bce27-6e2e-46f8-a242-d5772dffd6a9","resolution":{"observed_at":"2026-07-31T00:05:16.739249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18096","last_updated":"2025-09-03T15:32:23Z","snapshot_observed_at":"2026-08-15T20:12:18.032530Z","submitted_at":"2025-06-22T16:52:48Z","title":"Deep Research Agents: A Systematic Examination And Roadmap","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18096","snapshot_observed_at":"2026-07-31T00:05:16.744284Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.744284Z"},"links":{"cited_paper":"/paper/2506.18096","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:4c46e2d883f295a976880749d7e7464a9efbe4fffdb9dcf364da8abfa8cc7cd6","observation_id":"4709d86c-c1a4-40d9-9f50-a7122421ba48","resolution":{"observed_at":"2026-07-31T00:05:16.744284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-19T15:02:06.571282Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-07-31T00:05:16.749966Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.749966Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:0fca13343d176f8ed7e604f4f6f6755a1b74b1b3d1988258c1207dc67034bcb4","observation_id":"10752821-d4e1-44bf-90eb-44ffccd332c5","resolution":{"observed_at":"2026-07-31T00:05:16.749966Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.04720","last_updated":"2026-01-19T09:03:26Z","snapshot_observed_at":"2026-08-14T12:22:57.900954Z","submitted_at":"2026-01-08T08:36:06Z","title":"Qwen3-VL-Embedding and Qwen3-VL-Reranker: A Unified Framework for State-of-the-Art Multimodal Retrieval and Ranking","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.04720","snapshot_observed_at":"2026-07-31T00:05:16.755226Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.755226Z"},"links":{"cited_paper":"/paper/2601.04720","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:625beee8a45ed2838e1276f7516c334f00b329fca966798a55f3ac1a38cdc187","observation_id":"31770f89-a81a-43d3-9fd7-72ccaa6c8e11","resolution":{"observed_at":"2026-07-31T00:05:16.755226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.760344Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.760344Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:0a9f482aa3d378db6fb794749157d8ce8fac0e1d2e911c9bfa00ec9834419cdc","observation_id":"011ecc67-ea7b-4fce-93f8-b1c90a1a3940","resolution":{"observed_at":"2026-07-31T00:05:16.760344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.765030Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.765030Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:00c813b5bd85f71b2643822cc3d3c2c3915d9eb99f62459cadb635f3c53c569c","observation_id":"1ba3cd60-789d-46df-bfd5-9b53335a5558","resolution":{"observed_at":"2026-07-31T00:05:16.765030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.774878Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.774878Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:64fc1d267eb8352555570b81894e0b272a2c2bd35d77f851ccffbe57f5aeb471","observation_id":"5d339781-2eb9-46c2-bd17-9a88633b1709","resolution":{"observed_at":"2026-07-31T00:05:16.774878Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.779725Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.779725Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:61a7ff284ebaca5f6cb7da59cfd59b41ed3ab7ce0bf583bfe1276a934dc99a21","observation_id":"357f766b-241e-4a26-a364-201cc9712cf5","resolution":{"observed_at":"2026-07-31T00:05:16.779725Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.784654Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.784654Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:a1ad6b60692e5354f0d9916cb9ea890609c1b9dfdb5af4213b3a1072747b247f","observation_id":"aabb2251-f701-4c23-807a-fc436e3e065c","resolution":{"observed_at":"2026-07-31T00:05:16.784654Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.789356Z","title":"2026.Seed 2.0 Model Card: Towards Intelligence Frontier for Real- World Complexity","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.789356Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:118fda72da85701a965a794946fe1a2f77783d514595361f68417fd324100e1b","observation_id":"5518d939-4809-471f-ab70-7a39bf20c051","resolution":{"observed_at":"2026-07-31T00:05:16.789356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.799288Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.799288Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:7555a93fa14bdb3ab820061b536b5aa40d81372f376a50fe5496a4fc5a7676cb","observation_id":"edfe982d-7376-4ec2-8486-30dd4f3a02ea","resolution":{"observed_at":"2026-07-31T00:05:16.799288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.803882Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.803882Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:979f4189178d2543638558d6d0c2b903c32fea1c29794392ee6e088a0a2d42fa","observation_id":"e2925050-8c17-430e-a435-4442ebb4bab8","resolution":{"observed_at":"2026-07-31T00:05:16.803882Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.793964Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.793964Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:f571388b9fa59e42f22f2b9976617a7931213d330b00674e0f2e29226561afe5","observation_id":"e42d8855-4071-483e-be2d-7d23fb256328","resolution":{"observed_at":"2026-07-31T00:05:16.793964Z","resolver_source":null,"status":"parse_uncertain"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.09733","last_updated":"2026-07-28T12:35:46Z","snapshot_observed_at":"2026-08-16T16:15:09.378320Z","submitted_at":"2025-10-10T13:34:23Z","title":"VisRAG2.0: Mitigating Visual Hallucinations via Evidence-Guided Multi-Image Reasoning in Visual Retrieval-Augmented Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.09733","snapshot_observed_at":"2026-07-31T00:05:16.817803Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.817803Z"},"links":{"cited_paper":"/paper/2510.09733","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:a126011d2a866d0270f60ec6140ad813d97aa43c10a5d81b8bad7bec8382dfbe","observation_id":"0c1c64e5-43e1-4b3d-936e-77c1ad65fa16","resolution":{"observed_at":"2026-07-31T00:05:16.817803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.02770","last_updated":"2026-07-02T21:08:53Z","snapshot_observed_at":"2026-08-18T16:22:37.329414Z","submitted_at":"2026-07-02T21:08:53Z","title":"Gemma 4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.02770","snapshot_observed_at":"2026-07-31T00:05:16.822448Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.822448Z"},"links":{"cited_paper":"/paper/2607.02770","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:ebe69ac5188169025f8559317216c09481f3276fb89802ccbd90ba09c380dc6a","observation_id":"2a567ec1-6790-4fab-af52-e84a06efff60","resolution":{"observed_at":"2026-07-31T00:05:16.822448Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-08-20T18:27:04.837880Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-07-31T00:05:16.827583Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.827583Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:84bb463cddcf8b8fbccf7a3ece1c4176a5e0f91e1a8cfbaba3378ff70a985275","observation_id":"9b4bb5ba-6c28-417c-be93-d7102c473428","resolution":{"observed_at":"2026-07-31T00:05:16.827583Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.813466Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.813466Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:8b89128d1dc6906e97ac6f6738abede7a29bd6716833b7ba7b4ee6466b87b89c","observation_id":"e3284bed-c07f-4b2b-b1c0-5fad716b056c","resolution":{"observed_at":"2026-07-31T00:05:16.813466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-07-31T00:05:16.837297Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.837297Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:a972c9c6ed0053d69dc36cce8fc039f92bfbedbea24d4ece9ee3e2baa86fea10","observation_id":"0e499cd7-77af-4c18-a26f-a11186dcddcd","resolution":{"observed_at":"2026-07-31T00:05:16.837297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.842138Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.842138Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:53ec0fdc7bfcdf74a73a41333ebccc26de7857ee3a022aeb13b85b67e894d96f","observation_id":"deccf5d6-9aae-4240-b2ee-bc756c1a2f33","resolution":{"observed_at":"2026-07-31T00:05:16.842138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.846641Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.846641Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:56d917e4dba3c2dcf4f88a9642b3174c305de51d9c1861f229ba463df2edd45c","observation_id":"a81ca673-acde-473b-9eb7-5895c7b8d24e","resolution":{"observed_at":"2026-07-31T00:05:16.846641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14240","last_updated":"2026-04-18T20:15:08Z","snapshot_observed_at":"2026-08-02T07:18:59.946811Z","submitted_at":"2025-10-16T02:49:16Z","title":"LiveResearchBench: A Live Benchmark for User-Centric Deep Research in the Wild","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.14240","snapshot_observed_at":"2026-07-31T00:05:16.856365Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.856365Z"},"links":{"cited_paper":"/paper/2510.14240","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:fc08cc9631a6023ad62eae7903a8f9baeb739cdb6d3f64ad9448910329fbd807","observation_id":"14516e7e-2c10-4f06-88f1-e391efb15392","resolution":{"observed_at":"2026-07-31T00:05:16.856365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18017","last_updated":"2025-06-03T05:34:30Z","snapshot_observed_at":"2026-08-16T12:55:26.347052Z","submitted_at":"2025-02-25T09:26:12Z","title":"ViDoRAG: Visual Document Retrieval-Augmented Generation via Dynamic Iterative Reasoning Agents","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.18017","snapshot_observed_at":"2026-07-31T00:05:16.861103Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.861103Z"},"links":{"cited_paper":"/paper/2502.18017","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:a3014f9618c50224ab2770f8be6ed3825a2683be39e44888da41bccc812be426","observation_id":"75ad234d-2012-492a-a0f7-a1d136cadeeb","resolution":{"observed_at":"2026-07-31T00:05:16.861103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-07-31T00:05:16.866225Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.866225Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:d8fc35c927a51e3a89413ab22962ab239653639990f6425794acd8677da422c3","observation_id":"f68f30ac-8dc0-49f5-9177-46cdb6b73343","resolution":{"observed_at":"2026-07-31T00:05:16.866225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.04499","last_updated":"2025-09-02T00:32:38Z","snapshot_observed_at":"2026-08-13T07:34:30.877589Z","submitted_at":"2025-09-02T00:32:38Z","title":"DeepTRACE: Auditing Deep Research AI Systems for Tracking Reliability Across Citations and Evidence","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.04499","snapshot_observed_at":"2026-07-31T00:05:16.851179Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.851179Z"},"links":{"cited_paper":"/paper/2509.04499","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:31697f7e67879f82524b44eff6e5b7c2cb8f279066285ab399cbb4a88407deda","observation_id":"0d4dc21a-3bc8-4671-9efc-deb5df358022","resolution":{"observed_at":"2026-07-31T00:05:16.851179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.881351Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.881351Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:07b0fd59f1ed9b989afff672993d88a96ddbcc5a08156d9efab17dc31689514a","observation_id":"0c5eb4af-6eb9-47fa-b956-8fa86a3dce8e","resolution":{"observed_at":"2026-07-31T00:05:16.881351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02404","last_updated":"2025-06-20T02:42:32Z","snapshot_observed_at":"2026-08-16T01:50:17.758639Z","submitted_at":"2025-06-03T03:44:26Z","title":"GraphRAG-Bench: Challenging Domain-Specific Reasoning for Evaluating Graph Retrieval-Augmented Generation","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02404","snapshot_observed_at":"2026-07-31T00:05:16.886205Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.886205Z"},"links":{"cited_paper":"/paper/2506.02404","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:91900ccb4828053571db22a02b953a0682f25e9326ef5d7a6fc01dc7e1ae6101","observation_id":"9e229604-63b9-44f2-b83a-281b864a11df","resolution":{"observed_at":"2026-07-31T00:05:16.886205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03569","last_updated":"2025-06-04T04:32:54Z","snapshot_observed_at":"2026-08-19T14:19:04.114322Z","submitted_at":"2025-06-04T04:32:54Z","title":"MiMo-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03569","snapshot_observed_at":"2026-07-31T00:05:16.891205Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.891205Z"},"links":{"cited_paper":"/paper/2506.03569","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:16b5c83b76db2fa692286d555387419c7f0ab7f720764451fe502ed0d92631bb","observation_id":"958d1bf7-dbaf-43b6-8f45-47cd133a3c08","resolution":{"observed_at":"2026-07-31T00:05:16.891205Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.871502Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.871502Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:087fbbd6adefc952c4932c99cf3410b197304c3e429d98abe6f3ca0aad819949","observation_id":"4ed39f3a-9b5e-4421-959e-b60edf42ff48","resolution":{"observed_at":"2026-07-31T00:05:16.871502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12516","last_updated":"2025-04-16T22:27:45Z","snapshot_observed_at":"2026-08-19T14:42:43.739745Z","submitted_at":"2025-04-16T22:27:45Z","title":"BrowseComp: A Simple Yet Challenging Benchmark for Browsing Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.12516","snapshot_observed_at":"2026-07-31T00:05:16.876354Z","title":"arXiv preprint arXiv:2504.12516(2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.876354Z"},"links":{"cited_paper":"/paper/2504.12516","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:8311e73b91560b0e9498e658af80e0ad898f03157c528c2344c5bf57e44a76ad","observation_id":"12a5a5f1-4c46-4e65-8a9f-cabbca65552b","resolution":{"observed_at":"2026-07-31T00:05:16.876354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.23061","last_updated":"2026-04-14T04:49:27Z","snapshot_observed_at":"2026-08-16T17:18:19.993705Z","submitted_at":"2026-02-26T14:48:49Z","title":"MoDora: Tree-Based Semi-Structured Document Analysis System","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.23061","snapshot_observed_at":"2026-07-31T00:05:16.906099Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.906099Z"},"links":{"cited_paper":"/paper/2602.23061","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:1fc87e80d17781cfe6390b834eff540c19b1d1ba60cbef076464bed66d3de14a","observation_id":"8fa8ee35-5f3f-4068-afb6-daf1da231707","resolution":{"observed_at":"2026-07-31T00:05:16.906099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12594","last_updated":"2025-06-14T18:19:05Z","snapshot_observed_at":"2026-08-16T02:27:50.910548Z","submitted_at":"2025-06-14T18:19:05Z","title":"A Comprehensive Survey of Deep Research: Systems, Methodologies, and Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12594","snapshot_observed_at":"2026-07-31T00:05:16.910931Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.910931Z"},"links":{"cited_paper":"/paper/2506.12594","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:06045f501be7d17a77f0d82fa4c08cab56c53f1a85b8df3d16e28a7f650e9844","observation_id":"83e4806d-a315-4673-8f03-47301ddbc48a","resolution":{"observed_at":"2026-07-31T00:05:16.910931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-31T00:05:16.915785Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.915785Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:78dfda56ce1ed28f7b94a6d63b33c97d5282bba7c8fd7f0ea6a05bd8e1572bc4","observation_id":"4eae3d1a-c56d-4be9-b7ef-6f209858c634","resolution":{"observed_at":"2026-07-31T00:05:16.915785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.896077Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.896077Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:86a0e23215c52d360d11635a07320c0e31aee555f851b3c86a22f69db18af4dc","observation_id":"aaccfea5-1d49-4fc5-98f4-dec4592b5a78","resolution":{"observed_at":"2026-07-31T00:05:16.896077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.901313Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.901313Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:ea920b14d530647302f99726df08e5d6a99350355c96b889e84250001260facc","observation_id":"ddd4be1d-df2b-4b5b-b8fa-6867ae6e0afd","resolution":{"observed_at":"2026-07-31T00:05:16.901313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.929799Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.929799Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:ac82462bed5a7d9d2bbab7b1c9cbf2b9e5faf5cbc6ed42f15d352979fdf55bac","observation_id":"91c9fa17-9da5-44de-84fc-cd135955548e","resolution":{"observed_at":"2026-07-31T00:05:16.929799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-07-31T00:05:16.934606Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.934606Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:5b79c43b293997424af9bd086b7bca4bb908c89ae418066dccf6613ceeba521f","observation_id":"2e3e463e-9b43-4dfe-b645-14ddc3e7e6d7","resolution":{"observed_at":"2026-07-31T00:05:16.934606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.939678Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.939678Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:eab98d9c541342112f444f7381d1b8d7647d0ea06521d7969fe73b8d82b66760","observation_id":"bf1c24e1-e0d0-47b3-8754-35db393b0f3b","resolution":{"observed_at":"2026-07-31T00:05:16.939678Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.920337Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.920337Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:660f8f95545dceed57c9b7ddcd4e10a4e6bf8fbcdaeaf49bed03669481591e61","observation_id":"e8d1ed3c-b809-4d46-ad5e-a9f188fb4e51","resolution":{"observed_at":"2026-07-31T00:05:16.920337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.924957Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.924957Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:25aa02fda6bee122e74b76267213af14dbbb4781abd3dd456e702af10fe835ee","observation_id":"f615df95-7448-499a-845b-8871126ff8a9","resolution":{"observed_at":"2026-07-31T00:05:16.924957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.953855Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.953855Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:65ef1c91b8a5baf2b672c0c56484e4a4b581dc05e78af30e4524b1ef5472f399","observation_id":"b96b7442-72ad-4eb3-8df0-ac708cfa23bb","resolution":{"observed_at":"2026-07-31T00:05:16.953855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.12752","last_updated":"2025-08-18T09:26:14Z","snapshot_observed_at":"2026-08-19T22:29:57.931613Z","submitted_at":"2025-08-18T09:26:14Z","title":"Deep Research: A Survey of Autonomous Research Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.12752","snapshot_observed_at":"2026-07-31T00:05:16.958525Z","title":"cover\">`-multiple `<div class=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.958525Z"},"links":{"cited_paper":"/paper/2508.12752","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:ec1c11d3c7c461bdb16dafcdea399665bc7d936f1348ffe4ec75bd400956b2a6","observation_id":"12791e9d-62f9-4ada-9d76-bb79f11ada4c","resolution":{"observed_at":"2026-07-31T00:05:16.958525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.944368Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.944368Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:0e07871f6d05c07906555596aefeaea8b699248eb85e4a4a495d19a92602f44f","observation_id":"8d745d51-dd81-4b6a-9d7b-57b9b26a0172","resolution":{"observed_at":"2026-07-31T00:05:16.944368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.949181Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.949181Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:a99c22b4b4bf503765d8c08edb09c405a24e2ca33728fa8c0340c07842954c08","observation_id":"12ae8d9e-ce40-41d1-b33a-066e8d9aeb80","resolution":{"observed_at":"2026-07-31T00:05:16.949181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2112.09332","last_updated":"2022-06-01T19:08:11Z","snapshot_observed_at":"2026-08-19T02:54:55.334346Z","submitted_at":"2021-12-17T05:43:43Z","title":"WebGPT: Browser-assisted question-answering with human feedback","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.09332","snapshot_observed_at":"2026-07-31T00:05:16.769806Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.769806Z"},"links":{"cited_paper":"/paper/2112.09332","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:e4c0c24e658dd97e3be284c3ef6eb0a6184c91e1890459703f787fb041a2d614","observation_id":"067df9be-4edf-42fe-adac-d745d4bfc2b2","resolution":{"observed_at":"2026-07-31T00:05:16.769806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-15T00:17:32.875866Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-07-31T00:05:16.808395Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.808395Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:5384a6c69971f45d9403cf46a4dfdd23b87dd4299109f712b47592e18bc02b76","observation_id":"bf8c3eda-26fc-4812-803d-cd039dcca41f","resolution":{"observed_at":"2026-07-31T00:05:16.808395Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-31T00:05:16.705517Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-07-31T00:05:16.705517Z"},"links":{"citing_paper":"/paper/2607.25151"},"observation_digest":"sha256:744e0a69055abcb69db1caf9fd1760d33e141d0dd7ab48e7647b04d64eefff8d","observation_id":"c16bbad8-eee0-4cfa-bfa3-880ed368b460","resolution":{"observed_at":"2026-07-31T00:05:16.705517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25151","last_updated":"2026-07-27T23:50:46Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-13T03:25:14.377953Z","submitted_at":"2026-07-27T23:50:46Z","title":"HiEviDR-Bench: A Benchmark for Hierarchical Evidence Aggregation in Deep Research"},"reference_resolution":{"displayed":53,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":52,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":53},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-21T06:32:19.484+00:00","source":"crossref"},{"observed_at":"2026-08-21T06:32:16.066871+00:00","source":"retraction_watch"}],"thesis":"As of 21 August 2026, this Paper Citation Record lists 53 of 53 outbound references and 0 inbound Pith citation observations for arXiv:2607.25151."}