{"as_of":"2026-08-11T15:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:638e916ad092a8bad8911efc3c8ee9b40b1ca7b13bf8d6913a5244bd46439324","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T00:31:23.873113Z","state":"measured"},{"denominator":38,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":38,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.07641/citation-record","integrity":"/paper/2608.07641/integrity","json":"/paper/2608.07641/citation-record.json","paper":"/paper/2608.07641"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.530690Z","title":null,"venue":null,"work_id":"deb78349-fbcb-474e-b4f6-8e4faf11ff5e","year":2008},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.749154Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:103676d768612507b522432eac776cb948ed3eb6b2d27670629cb9fbbe4a7ba8","observation_id":"3924a3d8-451f-42af-9fc3-6f389f4c4b62","resolution":{"observed_at":"2026-08-11T00:31:24.533957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.753461Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.753461Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:634f05a3e2ef77e2472b0b079ab33f24a6e762c6ed4bea7706338bfc382daa89","observation_id":"a713f248-510f-487b-bc75-cd7ceecc5264","resolution":{"observed_at":"2026-08-11T00:31:23.753461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.520925Z","title":null,"venue":null,"work_id":"6453f2d0-2612-4004-aeac-b4f5cc2656d8","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.757079Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:5aad1366d9265ca2caec9cf213b53a4bbab21fe9987e141c207a18986d949399","observation_id":"09b53882-0be5-4673-95d4-c4a0a4bea4d4","resolution":{"observed_at":"2026-08-11T00:31:24.524000Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.14317","last_updated":"2025-08-20T00:03:46Z","snapshot_observed_at":"2026-08-11T02:37:51.251369Z","submitted_at":"2025-08-20T00:03:46Z","title":"SurveyGen-I: Consistent Scientific Survey Generation with Evolving Plans and Memory-Guided Writing","version":1},"cited_work":{"arxiv_id":"2508.14317","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.14317","snapshot_observed_at":"2026-08-11T00:31:24.361568Z","title":"SurveyGen-I: Consistent Scientific Survey Generation with Evolving Plans and Memory-Guided Writing","venue":"cs.CL","work_id":"66e0e642-fba4-47dd-8954-5587dd703464","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.760399Z"},"links":{"cited_paper":"/paper/2508.14317","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:1846e666f6cb13a9aec93d8803a8414145bf18417b5a607103a43bee2c6ecd9a","observation_id":"5e4b0217-9082-419f-a3c2-3d51716fff63","resolution":{"observed_at":"2026-08-11T00:31:24.365738Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.02556","last_updated":"2025-12-02T09:25:14Z","snapshot_observed_at":"2026-07-31T23:49:25.878472Z","submitted_at":"2025-12-02T09:25:14Z","title":"DeepSeek-V3.2: Pushing the Frontier of Open Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.02556","snapshot_observed_at":"2026-08-11T00:31:23.764103Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.764103Z"},"links":{"cited_paper":"/paper/2512.02556","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:1351714423736dc3c6f22bbaf0429fc2bf83b83a95aac8dc0dc69e188874e332","observation_id":"d4076298-feec-464a-81ea-808811e11447","resolution":{"observed_at":"2026-08-11T00:31:23.764103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.11763","last_updated":"2025-06-13T13:17:32Z","snapshot_observed_at":"2026-08-07T14:15:18.269910Z","submitted_at":"2025-06-13T13:17:32Z","title":"DeepResearch Bench: A Comprehensive Benchmark for Deep Research Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.11763","snapshot_observed_at":"2026-08-11T00:31:23.767656Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.767656Z"},"links":{"cited_paper":"/paper/2506.11763","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:15a6f5252a91bac24f009a6d2ae22388edf31562caf8cfce4cd33e81d398f951","observation_id":"790f2f3c-7659-4145-9c24-78d43e9f6e4e","resolution":{"observed_at":"2026-08-11T00:31:23.767656Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.08008","last_updated":"2025-05-29T13:16:05Z","snapshot_observed_at":"2026-08-04T13:03:20.610282Z","submitted_at":"2024-04-10T01:26:24Z","title":"Sample-Efficient Human Evaluation of Large Language Models via Maximum Discrepancy Competition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.08008","snapshot_observed_at":"2026-08-11T00:31:23.771435Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.771435Z"},"links":{"cited_paper":"/paper/2404.08008","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:a2b49ca093609996b8b304c258f8b80ddf8aa00d140800baae56128b2310c3e3","observation_id":"73fa287c-4ea7-4f00-8d38-4fb7a4ee4c4a","resolution":{"observed_at":"2026-08-11T00:31:23.771435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.512611Z","title":null,"venue":null,"work_id":"7c43d411-d424-44e0-bd2b-dfb77b302cab","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.774909Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:b2f97bbeb2034114286c4049687156942ef905ee03a0a6e07b31b1ddd1868463","observation_id":"94f0ffaa-eac1-4b24-ab06-0643baf753df","resolution":{"observed_at":"2026-08-11T00:31:24.515481Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-08-11T08:20:29.798517Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-11T00:31:23.778032Z","title":"Hu, Yelong Shen, Phillip Wallis, Zeyuan Allen-Zhu, Yuanzhi Li, Shean Wang, Lu Wang, and Weizhu Chen","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.778032Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:b32608da7d342f89b9440e6f74cc88c72f930dad9d7d077e86619f0414294b7b","observation_id":"7b7dc261-6b9d-40c2-8bbf-684e6225d3d7","resolution":{"observed_at":"2026-08-11T00:31:23.778032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.06708","last_updated":"2026-04-17T05:08:56Z","snapshot_observed_at":"2026-07-06T22:31:58.848080Z","submitted_at":"2025-10-08T06:59:23Z","title":"AISysRev -- LLM-based Tool for Title-abstract Screening","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.06708","snapshot_observed_at":"2026-08-11T00:31:23.781493Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.781493Z"},"links":{"cited_paper":"/paper/2510.06708","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:dd57e563b39f9384165c5b6a771269538c1dbeb99121875320c2d61440e06ac0","observation_id":"a961bc0e-c835-4177-b8aa-8617c15eef7f","resolution":{"observed_at":"2026-08-11T00:31:23.781493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15804","last_updated":"2025-08-14T03:33:43Z","snapshot_observed_at":"2026-08-11T02:36:10.774752Z","submitted_at":"2025-08-14T03:33:43Z","title":"ReportBench: Evaluating Deep Research Agents via Academic Survey Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15804","snapshot_observed_at":"2026-08-11T00:31:23.785317Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.785317Z"},"links":{"cited_paper":"/paper/2508.15804","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:07fa47556a306bd4b3035c873c52f87647237bfe52cefa52d246a0c626e7e5cf","observation_id":"7af85fb0-70f3-422c-855f-4d0a9a5d2e88","resolution":{"observed_at":"2026-08-11T00:31:23.785317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14776","last_updated":"2025-02-27T06:30:11Z","snapshot_observed_at":"2026-08-07T18:01:14.512854Z","submitted_at":"2025-02-20T17:59:45Z","title":"SurveyX: Academic Survey Automation via Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.14776","snapshot_observed_at":"2026-08-11T00:31:23.788693Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.788693Z"},"links":{"cited_paper":"/paper/2502.14776","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:93d80790222e606292963858ecc21cebfbdb2de786a964f366ec216a7a8a3bcb","observation_id":"bdb46811-2fc9-4f22-b013-768041583a23","resolution":{"observed_at":"2026-08-11T00:31:23.788693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.791995Z","title":null,"venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.791995Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:91b6b990943ee0a269a8c71be7172b51d59fe8938b6b20117e432d51ebc7d7d0","observation_id":"cc0d2034-d044-4b48-9c2d-a070513434c8","resolution":{"observed_at":"2026-08-11T00:31:23.791995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.795143Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.795143Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:0a713d10ca682a5cd1b5ba396af2ed2a2c522ed7c8e3a9d441439ae03c993fee","observation_id":"7b870f55-38d2-4aeb-80b6-639602bc4523","resolution":{"observed_at":"2026-08-11T00:31:23.795143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.494911Z","title":null,"venue":null,"work_id":"9ceb73d9-6df5-46bb-8d3d-c4de22b7ee17","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.797905Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:c6628b4af78ee5b587f51c11e91dbfeeb47c06364a82c484c694c9d32a1333de","observation_id":"79eaf0f7-7057-452b-829c-70b36bf0cbe8","resolution":{"observed_at":"2026-08-11T00:31:24.499214Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.800478Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.800478Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:54e3de199759c7820796715ff4637e11480cd227668808be0e736832fcda7a78","observation_id":"819e9d4c-8bd3-460f-b6fe-caf5eeb5976c","resolution":{"observed_at":"2026-08-11T00:31:23.800478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.484031Z","title":null,"venue":null,"work_id":"5cff7bbf-dfe6-4407-b4d0-9518541bdb22","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.803189Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:b521492eba4a9b1c1a68c85c80f74773f4229f2ca20d6b8b87ce8088ff3fc207","observation_id":"e692909d-9f6b-4740-911a-a4bd1f623555","resolution":{"observed_at":"2026-08-11T00:31:24.487919Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-11T00:31:23.805873Z","title":"Manning, and Chelsea Finn","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.805873Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:28fc2696471c394ca88b1394fdf12d21eb1b0b85776bad040b4ea13c4daa2e13","observation_id":"8a5ed21f-0bc2-4660-9ec8-b122d69382fa","resolution":{"observed_at":"2026-08-11T00:31:23.805873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.473592Z","title":"Howcroft, Ondřej Plátek, and Adarsa Sivaprasad","venue":null,"work_id":"87e69623-5022-4e18-9881-812bc9767ad9","year":null},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.808941Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:426d4c0484fabe42af4fb7cfaa210003d08d04bc4a842bcf5f0d8164548b03e5","observation_id":"2028d1a5-979c-4dda-b75b-5cfafa1cd86a","resolution":{"observed_at":"2026-08-11T00:31:24.477452Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.12689","last_updated":"2025-07-21T03:49:38Z","snapshot_observed_at":"2026-08-07T21:58:25.001847Z","submitted_at":"2025-06-15T02:23:47Z","title":"SciSage: A Multi-Agent Framework for High-Quality Scientific Survey Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.12689","snapshot_observed_at":"2026-08-11T00:31:23.816102Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.816102Z"},"links":{"cited_paper":"/paper/2506.12689","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:780a7ca83692fda400364f0fc81570df4bba2dc2f627bf080e40c78661f68c12","observation_id":"c0f0c7a2-0c72-4bb1-a593-625530128592","resolution":{"observed_at":"2026-08-11T00:31:23.816102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.15658","last_updated":"2026-05-02T18:02:31Z","snapshot_observed_at":"2026-07-06T22:16:15.447310Z","submitted_at":"2025-08-21T15:45:10Z","title":"SurGE: A Benchmark and Evaluation Framework for Scientific Survey Generation","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.15658","snapshot_observed_at":"2026-08-11T00:31:23.819644Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.819644Z"},"links":{"cited_paper":"/paper/2508.15658","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:651f1084b35fca22fa52c93afe10b31648aca6e86d51d431f07d10f7f0b350f8","observation_id":"bc363558-9a3c-4b7f-a0c3-03abdb0efcc4","resolution":{"observed_at":"2026-08-11T00:31:23.819644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21537","last_updated":"2025-05-24T09:07:13Z","snapshot_observed_at":"2026-08-08T02:37:32.325481Z","submitted_at":"2025-05-24T09:07:13Z","title":"OpenReview Should be Protected and Leveraged as a Community Asset for Research in the Era of Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.21537","snapshot_observed_at":"2026-08-11T00:31:23.822952Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.822952Z"},"links":{"cited_paper":"/paper/2505.21537","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:17d08240aa854bf80b41f964557d8268217a1cc62c07f0d9cc4168d32f15eaa2","observation_id":"179b090c-4dcc-4733-856d-c1847557fa41","resolution":{"observed_at":"2026-08-11T00:31:23.822952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.826470Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.826470Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:c0adccb358a0aefc6f0ecf80e1d0919141e1c70e7d42aa55b94d4327dc194223","observation_id":"841d9628-a6ae-48ea-ad47-a99da211c31c","resolution":{"observed_at":"2026-08-11T00:31:23.826470Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.829615Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.829615Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:53988e4f7d94cb593a49a4437a550a12aa5cc9c1aafa37bff7499f90c1f18f9e","observation_id":"b94c7428-d8ae-4fd9-b4e0-5765ae142366","resolution":{"observed_at":"2026-08-11T00:31:23.829615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1911.03379","last_updated":"2019-11-08T16:59:50Z","snapshot_observed_at":"2026-08-11T11:09:02.880586Z","submitted_at":"2019-11-08T16:59:50Z","title":"Does the use of open, non-anonymous peer review in scholarly publishing introduce bias? Evidence from the F1000 post-publication open peer review publishing model","version":1},"cited_work":{"arxiv_id":"1911.03379","doi":null,"metadata_source":"pith","pith_arxiv_id":"1911.03379","snapshot_observed_at":"2026-08-11T00:31:23.979202Z","title":"Does the use of open, non-anonymous peer review in scholarly publishing introduce bias? Evidence from the F1000 post-publication open peer review publishing model","venue":"cs.DL","work_id":"62f6e368-448d-496e-97ff-d929c4c4286f","year":2019},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.832554Z"},"links":{"cited_paper":"/paper/1911.03379","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:57f40ce0427d532aae0cc0e9fcab27adb9b55670aeaaaa8b975672a05507d7c1","observation_id":"7a8ba177-7172-45de-81a9-9066a89a3da2","resolution":{"observed_at":"2026-08-11T00:31:23.983666Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05732","last_updated":"2025-04-15T03:28:58Z","snapshot_observed_at":"2026-08-07T16:07:39.794751Z","submitted_at":"2025-04-08T07:03:48Z","title":"LLM$\\times$MapReduce-V2: Entropy-Driven Convolutional Test-Time Scaling for Generating Long-Form Articles from Extremely Long Resources","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.05732","snapshot_observed_at":"2026-08-11T00:31:23.836183Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.836183Z"},"links":{"cited_paper":"/paper/2504.05732","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:82095554fdf4b14da7ef4e06807fb829c724901291143ebd85f96de9d70c8275","observation_id":"4a14c638-8bfa-4522-9383-736cadac34e3","resolution":{"observed_at":"2026-08-11T00:31:23.836183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10252","last_updated":"2024-06-18T02:11:31Z","snapshot_observed_at":"2026-07-06T18:31:13.039726Z","submitted_at":"2024-06-10T12:56:06Z","title":"AutoSurvey: Large Language Models Can Automatically Write Surveys","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10252","snapshot_observed_at":"2026-08-11T00:31:23.839626Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.839626Z"},"links":{"cited_paper":"/paper/2406.10252","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:9ebe0e80494d1274b6197f2da5e53c9e0e65ead60e873c2646679c84eb17349e","observation_id":"ee84d0dc-7ab3-4c76-adf5-0dc89c0b699f","resolution":{"observed_at":"2026-08-11T00:31:23.839626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.00816","last_updated":"2025-03-08T14:01:34Z","snapshot_observed_at":"2026-08-06T21:05:17.245196Z","submitted_at":"2024-10-28T08:10:21Z","title":"CycleResearcher: Improving Automated Research via Automated Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.00816","snapshot_observed_at":"2026-08-11T00:31:23.842997Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.842997Z"},"links":{"cited_paper":"/paper/2411.00816","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:fee4b93507e28eb81446946d277954de28018600c3fa22f40b7b93594a5a95c0","observation_id":"e0792c6b-2ed6-4ea2-9844-2837232c965f","resolution":{"observed_at":"2026-08-11T00:31:23.842997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-11T00:31:23.846328Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.846328Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:6bd3562121a1de83a3f996eccc9c585934e74006e0c8954877b3ab185806b90a","observation_id":"4ac32d02-660f-4817-83fe-fe2c10f08a68","resolution":{"observed_at":"2026-08-11T00:31:23.846328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.463514Z","title":null,"venue":null,"work_id":"d93fd5bb-6b30-4d3d-97cb-bf1f4c69ebfc","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.849666Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:648fad3b6c09f3bbad8154681368398be167c38a5ca3da595a17da897906cdcf","observation_id":"3089d24e-488a-4c47-a715-17111e0f2b79","resolution":{"observed_at":"2026-08-11T00:31:24.466798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:23.852835Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.852835Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:d273c87811aa36360e6bfa3cdb18450cf2fbbe899254d2d10bfffa50b6680dea","observation_id":"20f101cd-94b9-4bc8-8962-0b85c08f6c15","resolution":{"observed_at":"2026-08-11T00:31:23.852835Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.448147Z","title":null,"venue":null,"work_id":"72035ddb-d4be-4c01-9d48-18a7847cd3af","year":2024},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.855988Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:59692d3d50cf1ae5157940a408a5cda302dc407f9d42287dc8c99eea3258a521","observation_id":"ececf2d1-3e5b-437a-9409-518e298f06a2","resolution":{"observed_at":"2026-08-11T00:31:24.451662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.15307","last_updated":"2026-08-01T09:50:18Z","snapshot_observed_at":"2026-08-08T13:46:06.471776Z","submitted_at":"2026-01-13T14:42:56Z","title":"DeepSurvey-Bench: Evaluating Academic Value of Automatically Generated Scientific Surveys","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.15307","snapshot_observed_at":"2026-08-11T00:31:23.859081Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.859081Z"},"links":{"cited_paper":"/paper/2601.15307","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:6c7d55c47166d32a22e47feb2ee5e41f57d72aeb6dab1b40ed7cf5718b92bc5c","observation_id":"0e2e5183-96f3-4dcd-b257-9457e5d7b728","resolution":{"observed_at":"2026-08-11T00:31:23.859081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-11T00:31:23.863168Z","title":"Weinberger, and Yoav Artzi","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.863168Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:568b1506da92209f78d0497e7b28b42a887f5440f582b18b9920f6546e7da668","observation_id":"83583933-90ab-45ac-a456-917e71ca0574","resolution":{"observed_at":"2026-08-11T00:31:23.863168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05685","last_updated":"2023-12-24T02:01:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-06-09T05:55:52Z","title":"Judging LLM-as-a-Judge with MT-Bench and Chatbot Arena","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05685","snapshot_observed_at":"2026-08-11T00:31:23.866507Z","title":"Xing, Hao Zhang, Joseph E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.866507Z"},"links":{"cited_paper":"/paper/2306.05685","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:548f8474791937108cf91b10cbcc0c1e841b8f2798d5c7279d05b32dd864ec2b","observation_id":"2bf889b1-fe36-4fe9-a1d7-8b44ecf4a99d","resolution":{"observed_at":"2026-08-11T00:31:23.866507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T00:31:24.439157Z","title":null,"venue":null,"work_id":"f1a7f2dd-ba2c-4cc1-a250-50ca51e96e13","year":2025},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.869926Z"},"links":{"citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:17c6974d5dd4f580685c9a8e673f98889038d8249d0566d51c9fb063a5757ff1","observation_id":"11df19f6-a40a-4e77-94b4-12588f20959b","resolution":{"observed_at":"2026-08-11T00:31:24.442149Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10409","last_updated":"2024-02-16T02:21:59Z","snapshot_observed_at":"2026-08-11T12:26:12.005555Z","submitted_at":"2024-02-16T02:21:59Z","title":"Understanding Survey Paper Taxonomy about Large Language Models via Graph Representation Learning","version":1},"cited_work":{"arxiv_id":"2402.10409","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.10409","snapshot_observed_at":"2026-08-11T00:31:23.906683Z","title":"Understanding Survey Paper Taxonomy about Large Language Models via Graph Representation Learning","venue":"cs.CL","work_id":"3b2750da-4525-4626-92de-4ae5255d8f3d","year":2024},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.873113Z"},"links":{"cited_paper":"/paper/2402.10409","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:7b06217aa7765f55f245b5acf1a2e1b21f0e515cce187ffc41abb791d0b83bc8","observation_id":"0ba0a00f-db43-4584-a42d-df36841f118f","resolution":{"observed_at":"2026-08-11T00:31:23.911769Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09169","last_updated":"2024-08-17T11:13:10Z","snapshot_observed_at":"2026-08-10T02:41:11.109796Z","submitted_at":"2024-08-17T11:13:10Z","title":"Automatic Metrics in Natural Language Generation: A Survey of Current Evaluation Practices","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.09169","snapshot_observed_at":"2026-08-11T00:31:23.812295Z","title":"arXiv:2408.09169 [cs.CL] https://arxiv.org/abs/2408.09169","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T00:31:23.812295Z"},"links":{"cited_paper":"/paper/2408.09169","citing_paper":"/paper/2608.07641"},"observation_digest":"sha256:a03e3a058ff641178234fdd1c06f34a0b5f8203ca9168d505e698da717b64f0b","observation_id":"f475ab8c-f16a-4625-9b92-a97ad6b153b7","resolution":{"observed_at":"2026-08-11T00:31:23.812295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.07641","last_updated":"2026-08-07T16:11:46Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-11T15:16:21.084587Z","submitted_at":"2026-08-07T16:11:46Z","title":"SurveyReview: A Reviewer-Aligned Benchmark for Survey Evaluators"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":34,"verified_exact":3,"verified_fuzzy":1},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 0 inbound Pith citation observations for arXiv:2608.07641."}