{"as_of":"2026-08-20T22:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:502e56d459bec4d80ffe9804fd8578e4f41d50526133ac5a56b7ae55a5635042","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-16T11:58:22.641579Z","state":"measured"},{"denominator":89,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":89,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:07:42.694240Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-28T18:42:28.930343Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-08-07T14:56:35.190567Z","title":"Ai idea bench 2025: Ai research idea generation benchmark","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16938","last_updated":"2025-07-22T15:05:22Z","snapshot_observed_at":"2026-08-16T16:40:57.327341Z","submitted_at":"2025-05-22T17:27:43Z","title":"InternAgent: When Agent Becomes the Scientist -- Building Closed-Loop System from Hypothesis to Verification","version":3},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T14:56:35.190567Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2505.16938"},"observation_digest":"sha256:fd0010507bc695477d16ff7b07b2014513a2f931b37db04ce2039b22887d8bb4","observation_id":"5d9e6f68-d8a6-4da0-8dbe-6e1b3a893f03","resolution":{"observed_at":"2026-08-07T14:56:35.190567Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-08-07T13:43:22.887540Z","title":"Preprint, arXiv:2504.14191","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.21116","last_updated":"2025-05-27T12:36:14Z","snapshot_observed_at":"2026-08-20T22:11:39.436154Z","submitted_at":"2025-05-27T12:36:14Z","title":"Creativity in LLM-based Multi-Agent Systems: A Survey","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T13:43:22.887540Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2505.21116"},"observation_digest":"sha256:b809334b50c25ed102396452421e0542655e219890f0f1d0ee8d593a2fc0d591","observation_id":"4bc94ee8-8935-44bc-8ef0-b686a58b9cf7","resolution":{"observed_at":"2026-08-07T13:43:22.887540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-08-07T12:46:29.896693Z","title":"do anything now","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.23559","last_updated":"2025-05-29T15:35:58Z","snapshot_observed_at":"2026-08-18T12:47:50.943843Z","submitted_at":"2025-05-29T15:35:58Z","title":"SafeScientist: Toward Risk-Aware Scientific Discoveries by LLM Agents","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:29.896693Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2505.23559"},"observation_digest":"sha256:f72b6b9ca1d3e59f7550dd39edfeebbf0dbb931acfb0805ad19cc7555d891f02","observation_id":"b63b174f-8a0e-4df4-9e7e-d8c29bbf389b","resolution":{"observed_at":"2026-08-07T12:46:29.896693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-08-02T23:19:15.220053Z","title":"David Rein, Betty Li Hou, Asa Cooper Stickland, Jack- son Petty, Richard Yuanzhe Pang, Julien Dirani, Ju- lian Michael, and Samuel R Bowman","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14257","last_updated":"2026-06-22T06:59:51Z","snapshot_observed_at":"2026-08-20T05:45:21.258970Z","submitted_at":"2026-02-15T17:59:47Z","title":"AD-Bench: A Real-World, Trajectory-Aware Advertising Analytics Benchmark for LLM Agents","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-02T23:19:15.220053Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2602.14257"},"observation_digest":"sha256:7e8c049bde7de2046305b510ad6aeb260c438e17b752397c02182cdce3542037","observation_id":"0ce9a3a5-961c-4ee4-b7ea-01e36e925df1","resolution":{"observed_at":"2026-08-02T23:19:15.220053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-08-02T19:41:50.287221Z","title":"AI idea bench 2025: AI research idea generation benchmark,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.01421","last_updated":"2026-06-03T13:47:56Z","snapshot_observed_at":"2026-08-13T16:20:36.631389Z","submitted_at":"2026-03-02T03:53:20Z","title":"SciDER: Scientific Data-centric End-to-end Researcher","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T19:41:50.287221Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2603.01421"},"observation_digest":"sha256:70653cc776c29c935c3b86b68a0b4168e59e6fb79e235afaa5bac15532a5305b","observation_id":"8add1d33-042d-49c4-8709-cb9ed2737f75","resolution":{"observed_at":"2026-08-02T19:41:50.287221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":"2504.14191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-06-28T18:42:28.930343Z","title":"Gollam Rabby, Diyana Muhammed, Prasenjit Mitra, and Sören Auer","venue":null,"work_id":"6fbf9394-7bfc-45d1-9d00-234e848b5ac5","year":2025},"citing_paper":{"arxiv_id":"2604.28158","last_updated":"2026-05-01T14:37:29Z","snapshot_observed_at":"2026-08-11T14:09:45.921669Z","submitted_at":"2026-04-30T17:44:55Z","title":"Intern-Atlas: A Methodological Evolution Graph as Research Infrastructure for AI Scientists","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-07T06:42:17.145367Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2604.28158"},"observation_digest":"sha256:15880d86c9ac866a64252d7b9a33176118d2ab3954854ed631cd5304444d67ae","observation_id":"f1e60427-4787-4325-8b27-cb5a7741c716","resolution":{"observed_at":"2026-05-12T10:16:28.564631Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":"2504.14191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-06-28T18:42:28.930343Z","title":"Gollam Rabby, Diyana Muhammed, Prasenjit Mitra, and Sören Auer","venue":null,"work_id":"6fbf9394-7bfc-45d1-9d00-234e848b5ac5","year":2025},"citing_paper":{"arxiv_id":"2605.04922","last_updated":"2026-05-06T13:50:40Z","snapshot_observed_at":"2026-08-13T09:48:42.604811Z","submitted_at":"2026-05-06T13:50:40Z","title":"Evolving Idea Graphs with Learnable Edits-and-Commits for Multi-Agent Scientific Ideation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-08T15:34:46.766866Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2605.04922"},"observation_digest":"sha256:46dfafc01dcf25fb5bd743b6271465f6cc199394484bbd7ac04c57e62822a63f","observation_id":"abd265d6-0fff-44f7-a8db-07eff9a7cf2f","resolution":{"observed_at":"2026-05-11T18:36:06.848758Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":"2504.14191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-06-28T18:42:28.930343Z","title":"Gollam Rabby, Diyana Muhammed, Prasenjit Mitra, and Sören Auer","venue":null,"work_id":"6fbf9394-7bfc-45d1-9d00-234e848b5ac5","year":2025},"citing_paper":{"arxiv_id":"2605.16616","last_updated":"2026-05-15T20:35:32Z","snapshot_observed_at":"2026-08-16T06:46:32.334621Z","submitted_at":"2026-05-15T20:35:32Z","title":"MLReplicate: Benchmarking Autonomous Research Systems for Machine Learning Reproducibility","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-20T19:59:40.519962Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2605.16616"},"observation_digest":"sha256:ca9bb85b3af5994534837ab3e38dbc84879bba0dff8092a024a6f840faae749d","observation_id":"71594fa6-0b39-467d-a124-ec2601e58981","resolution":{"observed_at":"2026-05-20T20:03:43.974081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":"2504.14191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-06-28T18:42:28.930343Z","title":"Gollam Rabby, Diyana Muhammed, Prasenjit Mitra, and Sören Auer","venue":null,"work_id":"6fbf9394-7bfc-45d1-9d00-234e848b5ac5","year":2025},"citing_paper":{"arxiv_id":"2605.18661","last_updated":"2026-07-20T17:24:03Z","snapshot_observed_at":"2026-08-19T01:19:48.793908Z","submitted_at":"2026-05-18T17:08:26Z","title":"AI for Auto-Research: Roadmap & User Guide","version":1},"reference_index":154,"source":"pdf_text","source_observed_at":"2026-05-20T10:30:50.256635Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2605.18661"},"observation_digest":"sha256:7b7e03f0b199152634b2b1ec1025bdd9721bda0a3e5703d9af985e846a58f9ec","observation_id":"2b08c58d-21ba-43ef-bb78-325484a96e30","resolution":{"observed_at":"2026-05-20T10:33:12.456178Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-08-02T13:43:42.447834Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.18661","last_updated":"2026-07-20T17:24:03Z","snapshot_observed_at":"2026-08-19T01:19:48.793908Z","submitted_at":"2026-05-18T17:08:26Z","title":"AI for Auto-Research: Roadmap & User Guide","version":2},"reference_index":154,"source":"pdf_text","source_observed_at":"2026-08-02T13:43:42.447834Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2605.18661"},"observation_digest":"sha256:6e269ec1c7d15310cec3b19ad0977b14adb9bebe23350e66d2c9fb423464d371","observation_id":"fa165538-f407-4df4-979c-dd555cd76d2c","resolution":{"observed_at":"2026-08-02T13:43:42.447834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":"2504.14191","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-06-28T18:42:28.930343Z","title":"Gollam Rabby, Diyana Muhammed, Prasenjit Mitra, and Sören Auer","venue":null,"work_id":"6fbf9394-7bfc-45d1-9d00-234e848b5ac5","year":2025},"citing_paper":{"arxiv_id":"2606.00875","last_updated":"2026-05-30T20:15:01Z","snapshot_observed_at":"2026-08-13T15:33:13.203487Z","submitted_at":"2026-05-30T20:15:01Z","title":"IDEAFix: Evaluation Framework for Creative Defixation Prompting in LLMs","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-28T18:42:00.845492Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2606.00875"},"observation_digest":"sha256:a2714c5535a0e68c0ec8d741098092e9cae2fd161101e3388506b1d3e8e81d95","observation_id":"65f774b2-fc6b-47d6-babe-b801240feb91","resolution":{"observed_at":"2026-06-28T18:42:28.931783Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-07-11T19:11:37.739920Z","title":"AI idea bench 2025: AI research idea generation benchmark, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04439","last_updated":"2026-07-05T17:59:43Z","snapshot_observed_at":"2026-07-11T19:11:36.152412Z","submitted_at":"2026-07-05T17:59:43Z","title":"ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-11T19:11:37.739920Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2607.04439"},"observation_digest":"sha256:ee2d50805ab59c0595511f86b37e6b04a7d6a0de5a8ab4ea80d92d15ae57d2bc","observation_id":"7089f488-7244-44b6-b19f-033139c1cbef","resolution":{"observed_at":"2026-07-11T19:11:37.739920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-08-12T18:21:41.261437Z","title":"Marissa Radensky, Simra Shahid, Raymond Fok, Pao Siangliulue, Tom Hope, and Daniel S","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.10740","last_updated":"2026-08-11T09:56:55Z","snapshot_observed_at":"2026-08-18T22:19:28.120806Z","submitted_at":"2026-08-11T09:56:55Z","title":"Tree-of-Ideas: Automated Research Ideation via Cross-Trajectory Reasoning over Scholarly Evolution","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:21:41.261437Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2608.10740"},"observation_digest":"sha256:06716be4e9a6b6145c827c85a876770c41c94e211fb48f763d7f5882d8258e41","observation_id":"552513ba-3072-4de0-9893-a9fa6b36bb6f","resolution":{"observed_at":"2026-08-12T18:21:41.261437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.14191","snapshot_observed_at":"2026-08-15T16:07:42.694240Z","title":"arXiv preprint arXiv:2504.14191 , year=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.13136","last_updated":"2026-08-13T12:11:23Z","snapshot_observed_at":"2026-08-20T10:22:58.407391Z","submitted_at":"2026-08-13T12:11:23Z","title":"LigBench: A Unified and Human-Aligned Benchmark for LLM-based Research Idea Generation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T16:07:42.694240Z"},"links":{"cited_paper":"/paper/2504.14191","citing_paper":"/paper/2608.13136"},"observation_digest":"sha256:c46c4d41de654fc8d6a89a1fc4965711eec4d29ec2a951e35c054e6f066f0d49","observation_id":"21dc9f61-24d9-4954-a9f2-80e9d54ba09b","resolution":{"observed_at":"2026-08-15T16:07:42.694240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2504.14191/citation-record","integrity":"/paper/2504.14191/integrity","json":"/paper/2504.14191/citation-record.json","paper":"/paper/2504.14191"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-17T09:58:46.058102Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-16T11:58:20.998095Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:20.998095Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:3f5b689e117bd9f4fea2f2b13d842bf622a2234ea2ce9fe8bd24650b96b5e9e8","observation_id":"08aed1e6-045d-4a6a-84b8-be6f3c03d13e","resolution":{"observed_at":"2026-08-16T11:58:20.998095Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-16T11:58:21.004385Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.004385Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:695a089f4acb77f66be4d6f73844c60244881a02c878a759c9a66a91e0042de7","observation_id":"7755de76-4627-43e3-8e9e-8218e2df43da","resolution":{"observed_at":"2026-08-16T11:58:21.004385Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-08-17T11:08:48.802438Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-16T11:58:21.009030Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.009030Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:bdebace31968270af66fb529858240968f5a0a3c6f3871c812f8fc57f41c1b28","observation_id":"7d1f7226-ff5a-4552-b6ce-858923073dbb","resolution":{"observed_at":"2026-08-16T11:58:21.009030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-08-18T18:18:37.449517Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-16T11:58:21.013688Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.013688Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:a4fa3a4068cf76c21fb343d4852e0332f038461da3f8a0446649a74ba3e6c339","observation_id":"c91815cc-2dd1-41f5-9725-e6f567909811","resolution":{"observed_at":"2026-08-16T11:58:21.013688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.12284","last_updated":"2024-05-03T17:36:07Z","snapshot_observed_at":"2026-08-13T10:57:13.012119Z","submitted_at":"2023-09-21T17:45:42Z","title":"MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.12284","snapshot_observed_at":"2026-08-16T11:58:21.019262Z","title":"Metamath: Bootstrap your own mathematical questions for large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.019262Z"},"links":{"cited_paper":"/paper/2309.12284","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:96a3f1c01783fe3bc9669a1131fdad79eea84dcc2d5592c83b5625b00d63df80","observation_id":"26871f81-af09-4a9f-8994-c599088c432d","resolution":{"observed_at":"2026-08-16T11:58:21.019262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.752887Z","title":"Leandojo: Theorem proving with retrieval-augmented language models","venue":null,"work_id":"cf1bd476-c3b7-4ceb-8448-665b0427931f","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.024473Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:5b9ffa58c4b43ab02b38cdeef09241cd899b8db750a98f40d6497bd93a9643e8","observation_id":"b62ff467-86f9-412a-bef8-ca3b4e4f7d20","resolution":{"observed_at":"2026-08-16T11:58:25.808071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.03374","last_updated":"2021-07-14T17:16:02Z","snapshot_observed_at":"2026-08-20T20:50:23.483838Z","submitted_at":"2021-07-07T17:41:24Z","title":"Evaluating Large Language Models Trained on Code","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.03374","snapshot_observed_at":"2026-08-16T11:58:21.033768Z","title":"Evaluating large language models trained on code","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.033768Z"},"links":{"cited_paper":"/paper/2107.03374","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:5af4984cd81d1ad0bf5c32417f7800e455314ec0ab3a464ba70172f62d5543d0","observation_id":"6bc73ca2-bf08-4896-a0c2-4030bb0a283e","resolution":{"observed_at":"2026-08-16T11:58:21.033768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.07361","last_updated":"2023-12-08T06:30:12Z","snapshot_observed_at":"2026-08-19T19:23:11.617639Z","submitted_at":"2023-11-13T14:26:12Z","title":"The Impact of Large Language Models on Scientific Discovery: a Preliminary Study using GPT-4","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.07361","snapshot_observed_at":"2026-08-16T11:58:21.039778Z","title":"The impact of large language models on scientific discovery: a preliminary study using gpt-4","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.039778Z"},"links":{"cited_paper":"/paper/2311.07361","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:33ffb5d71f218b624e910f6a2da1fc0fc7740de85cee083717be8294e698c1cc","observation_id":"52a620fe-45f9-4067-8ec1-7759258d388f","resolution":{"observed_at":"2026-08-16T11:58:21.039778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.02726","last_updated":"2024-06-12T08:40:15Z","snapshot_observed_at":"2026-08-16T15:02:57.966905Z","submitted_at":"2023-09-06T05:19:41Z","title":"Large Language Models for Automated Open-domain Scientific Hypotheses Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.02726","snapshot_observed_at":"2026-08-16T11:58:21.044920Z","title":"Large language models for automated open-domain scientific hypotheses discovery","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.044920Z"},"links":{"cited_paper":"/paper/2309.02726","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:e97f2c72cafd1ee8219c962ca66d0c7f8e353d98398a7018711e89623dc934a9","observation_id":"509c5a05-cbc5-4a57-9d6e-e6d9f57ccac1","resolution":{"observed_at":"2026-08-16T11:58:21.044920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14259","last_updated":"2024-06-03T21:15:28Z","snapshot_observed_at":"2026-08-16T15:30:32.746015Z","submitted_at":"2023-05-23T17:12:08Z","title":"SciMON: Scientific Inspiration Machines Optimized for Novelty","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14259","snapshot_observed_at":"2026-08-16T11:58:21.049231Z","title":"Scimon: Scientific inspiration machines optimized for novelty","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.049231Z"},"links":{"cited_paper":"/paper/2305.14259","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:35002ed38f65a88dcf0b6a832b76056c68f8ffdbc81ddaf5dfdcd26c9d5fdf92","observation_id":"c3819d28-3566-4dcc-96f6-c72bd19b4df9","resolution":{"observed_at":"2026-08-16T11:58:21.049231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.04326","last_updated":"2024-12-18T19:00:00Z","snapshot_observed_at":"2026-08-16T14:03:16.586699Z","submitted_at":"2024-04-05T18:00:07Z","title":"Hypothesis Generation with Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.04326","snapshot_observed_at":"2026-08-16T11:58:21.053610Z","title":"Hypothesis generation with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.053610Z"},"links":{"cited_paper":"/paper/2404.04326","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:8e43614a76fe91c7888c9983794e3489b4b57bd9972f37f61f8281ef5fd5c3be","observation_id":"5a1e522a-9c43-4f05-a897-ba7929f0bf36","resolution":{"observed_at":"2026-08-16T11:58:21.053610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07738","last_updated":"2025-02-09T08:15:44Z","snapshot_observed_at":"2026-08-16T14:01:45.252212Z","submitted_at":"2024-04-11T13:36:29Z","title":"ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07738","snapshot_observed_at":"2026-08-16T11:58:21.157138Z","title":"Researchagent: Iterative research idea generation over scientific literature with large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.157138Z"},"links":{"cited_paper":"/paper/2404.07738","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:c3725a25e112e71756e504cdd52d67f3cea920a108e5788dfc03d628728b97dc","observation_id":"b28058be-e15b-4d72-a911-49d96a05c0b5","resolution":{"observed_at":"2026-08-16T11:58:21.157138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08559","last_updated":"2024-05-22T14:35:15Z","snapshot_observed_at":"2026-08-16T14:52:35.421512Z","submitted_at":"2023-10-12T17:51:10Z","title":"Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08559","snapshot_observed_at":"2026-08-16T11:58:21.203000Z","title":"Phenomenal yet puzzling: Testing inductive reasoning capabilities of language models with hypothesis refinement","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.203000Z"},"links":{"cited_paper":"/paper/2310.08559","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:b924efb0eff8a8e364e3ff5301692d9d298e6fda7688c5efa0512b3bae0c582e","observation_id":"1c10d555-bd33-4690-b383-d07ec364fdd1","resolution":{"observed_at":"2026-08-16T11:58:21.203000Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02429","last_updated":"2024-10-31T17:04:59Z","snapshot_observed_at":"2026-08-16T13:04:03.685681Z","submitted_at":"2024-10-31T17:04:59Z","title":"IdeaBench: Benchmarking Large Language Models for Research Idea Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.02429","snapshot_observed_at":"2026-08-16T11:58:21.208391Z","title":"Ideabench: Benchmarking large language models for research idea generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.208391Z"},"links":{"cited_paper":"/paper/2411.02429","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:d8302996056081cd6fe885660b845de17eba5bfe9e2dd0b011321ab5c1bc2d41","observation_id":"5ef1136c-b052-4631-b15b-59ce40ba009a","resolution":{"observed_at":"2026-08-16T11:58:21.208391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-08-20T13:44:59.356502Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-16T11:58:21.212918Z","title":"The ai scientist: Towards fully automated open-ended scientific discovery","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.212918Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:572331cd2e335ae6ec55a0bbea6c07639ca6ab1c0e0553d41f586b0b77d956f6","observation_id":"f0577212-6a73-4d0a-9d16-f8a39968722a","resolution":{"observed_at":"2026-08-16T11:58:21.212918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:21.217865Z","title":"Mlr-copilot: Autonomous machine learning research based on large language models agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.217865Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:1768025a2167bb4f9aa8a0c8ad8a39c36906c64d5241cc658febd6839c5e7f1c","observation_id":"8a949227-e4b7-4ed9-ac30-22a72635fa55","resolution":{"observed_at":"2026-08-16T11:58:21.217865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.14255","last_updated":"2024-10-27T04:02:32Z","snapshot_observed_at":"2026-08-19T18:03:55.391779Z","submitted_at":"2024-10-18T08:04:36Z","title":"Nova: An Iterative Planning and Search Approach to Enhance Novelty and Diversity of LLM Generated Ideas","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.14255","snapshot_observed_at":"2026-08-16T11:58:21.223288Z","title":"Nova: An iterative planning and search approach to enhance novelty and diversity of llm generated ideas","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.223288Z"},"links":{"cited_paper":"/paper/2410.14255","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:742e7cbe6d2fbe8381de1f977c97549679c329b09a39560a73577b2881e8a756","observation_id":"99aed0dd-00e2-44c8-be33-d77df387b0bf","resolution":{"observed_at":"2026-08-16T11:58:21.223288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.23166","last_updated":"2025-02-17T08:59:45Z","snapshot_observed_at":"2026-08-20T12:38:16.901469Z","submitted_at":"2024-10-30T16:18:22Z","title":"SciPIP: An LLM-based Scientific Paper Idea Proposer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.23166","snapshot_observed_at":"2026-08-16T11:58:21.229759Z","title":"Scipip: An llm-based scientific paper idea proposer","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.229759Z"},"links":{"cited_paper":"/paper/2410.23166","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:8c4cdc86923e8f90bfaa5334af51fc5f6a6b75911d26e978bc0418c1e50d5742","observation_id":"d84fd79f-8995-467c-b846-7d34f410f312","resolution":{"observed_at":"2026-08-16T11:58:21.229759Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.09403","last_updated":"2025-05-27T03:47:05Z","snapshot_observed_at":"2026-08-20T16:11:40.053622Z","submitted_at":"2024-10-12T07:16:22Z","title":"Many Heads Are Better Than One: Improved Scientific Idea Generation by A LLM-Based Multi-Agent System","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.09403","snapshot_observed_at":"2026-08-16T11:58:21.315863Z","title":"Two heads are better than one: A multi-agent system has the potential to improve scientific idea generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.315863Z"},"links":{"cited_paper":"/paper/2410.09403","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:1ea128908ff494fb9dc8ee1ae9e28dbfb46c889282effabfa119203cda5204d6","observation_id":"51f4c60a-42da-433e-8b1a-90bf73520251","resolution":{"observed_at":"2026-08-16T11:58:21.315863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13185","last_updated":"2024-10-30T09:17:59Z","snapshot_observed_at":"2026-08-19T22:14:58.913620Z","submitted_at":"2024-10-17T03:26:37Z","title":"Chain of Ideas: Revolutionizing Research Via Novel Idea Development with LLM Agents","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13185","snapshot_observed_at":"2026-08-16T11:58:21.363302Z","title":"Chain of ideas: Revolutionizing research via novel idea development with llm agents","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.363302Z"},"links":{"cited_paper":"/paper/2410.13185","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:3f9e44140e0fba18f277c70640d7e133df5b552aabecd5ec166cad8865d0bbe1","observation_id":"6086f1bf-05d7-4b24-8136-1e93589b7198","resolution":{"observed_at":"2026-08-16T11:58:21.363302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04109","last_updated":"2024-09-06T08:25:03Z","snapshot_observed_at":"2026-08-17T16:36:25.101775Z","submitted_at":"2024-09-06T08:25:03Z","title":"Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04109","snapshot_observed_at":"2026-08-16T11:58:21.369684Z","title":"Can llms generate novel research ideas? a large-scale human study with 100+ nlp researchers","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.369684Z"},"links":{"cited_paper":"/paper/2409.04109","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:29425a4e8b6bcbabdcb53f25323e4edccceef81cf693f80ae6d7711eafe36f63","observation_id":"4f4bcc7b-1d31-4a35-887a-b2f34f469ef2","resolution":{"observed_at":"2026-08-16T11:58:21.369684Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.680490Z","title":"Openess: Event- based semantic scene understanding with open vocabularies","venue":null,"work_id":"bd69ced0-dcec-4c04-b03c-3c7c0cbcef62","year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.375055Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:0d90f1597f7f2d96fbbc07acd135be48ce8c7367108fb598c480a5e4909d1618","observation_id":"62e9133f-e188-4e26-b37e-6cfe68e63afc","resolution":{"observed_at":"2026-08-16T11:58:25.687810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:21.380476Z","title":"Learning transferable visual models from natural language supervision","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.380476Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:5d6bb63fbb1ad4a2a1ca5fc2ed9b2faa570ec130fc17f54ca05afb66b9a61084","observation_id":"a1e7d3b6-66eb-45b9-b8f5-6d1784038c4e","resolution":{"observed_at":"2026-08-16T11:58:21.380476Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.639033Z","title":"Ev-segnet: Semantic segmentation for event-based cameras","venue":null,"work_id":"a44239ec-77f4-41a4-9522-ac0a6e530dfb","year":2019},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.386025Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:3577297638dcb1dc011752313feb2fd930cd71772f7bf0e0ce49f16acf2a8fca","observation_id":"303a0ea5-f156-4304-b424-70d7584571a6","resolution":{"observed_at":"2026-08-16T11:58:25.644539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.581556Z","title":"Event-based vision: A survey","venue":null,"work_id":"15a969ce-8d9d-4157-8836-13d47066785f","year":2020},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.492678Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:ca1a4815e549ad164a7cb679165891f6560f4df40822f376a971456700500f7a","observation_id":"f6696076-6742-4b3f-a8f9-3bfd46bd941d","resolution":{"observed_at":"2026-08-16T11:58:25.626938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.466970Z","title":"Ess: Learning event-based semantic segmentation from still images","venue":null,"work_id":"2014ae2b-134d-4c40-a87d-e76217edcad5","year":2022},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.599354Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:28698e2448175ffe9ce99e28121782c6191d72b39003a26952a00252e331ee51","observation_id":"b46b5ac7-7877-40c8-9865-65b48091229b","resolution":{"observed_at":"2026-08-16T11:58:25.505728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:21.603879Z","title":"Slic superpixels compared to state-of-the-art superpixel methods","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.603879Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:7a35170c3cb57d6b58bcc9ca087784113482c3a5f805a49a81a6df376b9e7cf3","observation_id":"8916e62d-2a8a-45fd-bda3-9ab0d379cd0e","resolution":{"observed_at":"2026-08-16T11:58:21.603879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04271","last_updated":"2024-10-14T07:12:27Z","snapshot_observed_at":"2026-08-16T13:45:26.278808Z","submitted_at":"2024-06-06T17:22:08Z","title":"Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04271","snapshot_observed_at":"2026-08-16T11:58:21.609118Z","title":"Buffer of thoughts: Thought- augmented reasoning with large language models, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.609118Z"},"links":{"cited_paper":"/paper/2406.04271","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:9d84e63b47ec359c6dbef2870f0c871bcbb505ace5c55b0e9ab83cd7111b2829","observation_id":"57b1e4cb-25fa-48c4-b885-3b7febf057de","resolution":{"observed_at":"2026-08-16T11:58:21.609118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:21.613913Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.613913Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:282d2cd17e84189d7d412d852fb917b50c23fa91df6b054176b7a1cabacad069","observation_id":"fdc35fbf-1454-40ba-9e94-31677db8ce6e","resolution":{"observed_at":"2026-08-16T11:58:21.613913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:21.618198Z","title":"Tree of thoughts: Deliberate problem solving with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.618198Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:15bcd2038e567ee3e68ec30d29589e3e3523979c7235d272a92dda95fc93c91e","observation_id":"7f86ebcb-470a-422c-bdc1-19617311a48f","resolution":{"observed_at":"2026-08-16T11:58:21.618198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14688","last_updated":"2025-03-05T02:28:39Z","snapshot_observed_at":"2026-08-16T15:30:22.841808Z","submitted_at":"2023-05-24T03:51:31Z","title":"ExpertPrompting: Instructing Large Language Models to be Distinguished Experts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14688","snapshot_observed_at":"2026-08-16T11:58:21.622708Z","title":"Expertprompting: Instructing large language models to be distinguished experts","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.622708Z"},"links":{"cited_paper":"/paper/2305.14688","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:e04dd334e623c4ea2d667375b45d5873385158da9daffc4dd32a5d16cce7e7a9","observation_id":"7a8d405e-fabf-4a55-8c8b-7710e6dc0306","resolution":{"observed_at":"2026-08-16T11:58:21.622708Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.322008Z","title":"Pal: Program-aided language models","venue":null,"work_id":"02baf5ef-f15f-4308-985b-916eea0b61b8","year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.676417Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:9bba2c689405e2f105f5bfe4f843870d95728e364b95103667b92bdca004bd08","observation_id":"d65cd50e-bc0b-4970-82e7-79518ca618ce","resolution":{"observed_at":"2026-08-16T11:58:25.326711Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-08-16T01:49:22.176843Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-16T11:58:21.746473Z","title":"Self-consistency improves chain of thought reasoning in language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.746473Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:b0fe30a8c725f7164e78c9f327c98a675a103897fae0b8f3d3b4e2d20b3647ad","observation_id":"ffb3e6e1-411d-49d2-9384-328769ad5be5","resolution":{"observed_at":"2026-08-16T11:58:21.746473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.298702Z","title":"Large language models are few-shot clinical information extractors","venue":null,"work_id":"9cf135e4-c46a-4fe6-b46c-1974aa22baf9","year":2022},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.751380Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:6fb8d1d49e1a07fa6d2122703cf72aa328f251f9cbe46821ce14f2d7d1d974f1","observation_id":"61e191ab-ba7f-48da-9e9c-bfd5dffc7ae4","resolution":{"observed_at":"2026-08-16T11:58:25.305432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.224755Z","title":"Nlice: Synthetic medical record generation for effective primary healthcare differential diagnosis","venue":null,"work_id":"e11efeba-f961-4056-a30f-1efcf63d4f77","year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.756308Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:5e50ee610fc46350b3f5922579742eb50312b343f309d1cde9c8c9bd812dbf50","observation_id":"4b2e03f1-4830-4917-9a61-1b2e0ff17c81","resolution":{"observed_at":"2026-08-16T11:58:25.263947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.186412Z","title":"Ehrxqa: A multi-modal question answering dataset for electronic health records with chest x-ray images","venue":null,"work_id":"a6a993b9-c4d8-48fa-96b0-29581e38a8e6","year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.760736Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:01d9a5b9dac57bc6941bb1ac840935b2cc1fc7a9f960ed51bfab4f5bbbdfc762","observation_id":"58fdba56-8f57-4607-bb6d-751d33fa42cd","resolution":{"observed_at":"2026-08-16T11:58:25.191937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.129970Z","title":"Comparative accuracy of diagnosis by collective intelligence of multiple physicians vs individual physicians","venue":null,"work_id":"c633cfd9-cf11-44f4-ac8c-fcd50f50356d","year":2019},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.765493Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:b3e2e7a8a96fd8c4627128d56fff7991ef1f5a8b648d76ec393b942087a9d2b2","observation_id":"bb158785-13c0-4b9e-b35d-1b7cdc42d9da","resolution":{"observed_at":"2026-08-16T11:58:25.143659Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.958006Z","title":"The use of analytic hierarchy process for measuring the complexity of medical diagnosis","venue":null,"work_id":"f59d1f91-6370-46c3-81d7-63766648b45c","year":2020},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.770723Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:3c1bf69270c35390c513dc669faaea4b227cac83b01651310e1fb0118451646b","observation_id":"baf43570-f2e5-4604-9eed-28faff588fa0","resolution":{"observed_at":"2026-08-16T11:58:25.073329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.943569Z","title":"Koala: Key frame-conditioned long video-llm","venue":null,"work_id":"67cfb907-2685-4945-a239-e62014edebd0","year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.775364Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:d16135b38522ef3470e04be3f6f7faf41bc065551ea5b2be50df9f8a1b881646","observation_id":"b45a8295-e1a0-4ec1-8c50-d5651012a67c","resolution":{"observed_at":"2026-08-16T11:58:24.947731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-16T11:58:21.780047Z","title":"Videochat: Chat-centric video understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.780047Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:7c9911a07d7986524d34b3ecf03186cb29664494716b29814d522bff81b35d70","observation_id":"21b4328b-8c1b-40c2-aa7c-5b9bd622ff47","resolution":{"observed_at":"2026-08-16T11:58:21.780047Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.929116Z","title":"Egoschema: A diagnostic benchmark for very long-form video language understanding","venue":null,"work_id":"f00c308e-c826-4bc6-959b-9897f36bd023","year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.905401Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:5c5780a4100ac06440d964bf1dd55298641df286b89025ab8114c820eb2be846","observation_id":"9d1a3d3c-65ff-4dec-afce-9efe504630a2","resolution":{"observed_at":"2026-08-16T11:58:24.933636Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:21.946871Z","title":"Howto100m: Learning a text-video embedding by watching hundred million narrated video clips","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.946871Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:625c6d9b34b0e50405c4c07c8adb664772f3165aad265e17dea5a7bf72ccffb3","observation_id":"726d7a34-d195-4694-abe2-1bf9e8c08e4e","resolution":{"observed_at":"2026-08-16T11:58:21.946871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02858","last_updated":"2023-10-25T06:23:31Z","snapshot_observed_at":"2026-08-13T15:50:38.254753Z","submitted_at":"2023-06-05T13:17:27Z","title":"Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02858","snapshot_observed_at":"2026-08-16T11:58:21.952993Z","title":"Video-llama: An instruction-tuned audio-visual language model for video understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.952993Z"},"links":{"cited_paper":"/paper/2306.02858","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:bd224bc480eaa766f655feb925b22d29267e1fc4679d6ffec1b8746e7badf1c4","observation_id":"5137740b-5826-48e6-94e9-1b6820ff0d72","resolution":{"observed_at":"2026-08-16T11:58:21.952993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.904620Z","title":"Fine-grained cross-view geo- localization using a correlation-aware homography estimator","venue":null,"work_id":"7768ecec-e102-454f-b5d6-fd25de194b96","year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.957771Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:9db2804afdfa7cba8f36d875b6211efa5659bbb2d100d236ca4610b7e4ebf575","observation_id":"4751138d-ce50-438e-bf3d-e931aebdb1ba","resolution":{"observed_at":"2026-08-16T11:58:24.909355Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.890276Z","title":"R-tuning: Instructing large language models to say ‘i don’t know’","venue":null,"work_id":"eb92cce9-0c98-44a1-8135-e41e467eeafa","year":2024},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.962704Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:861d69baee41ed6d071cfd0391e35a384d4f1fabc72b325b00f5c28ab0441bf6","observation_id":"79a11e85-f7ee-41ae-860a-0da46d93c6c7","resolution":{"observed_at":"2026-08-16T11:58:24.895141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.875690Z","title":"Selfcheckgpt: Zero-resource black-box hallucination detection for generative large language models","venue":null,"work_id":"9550a643-bc34-4614-9abb-4ffa1ef42a4c","year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.967058Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:60046806022eb4f80c79e013d9673c46be1c56ce81bcee64b7b8e404f1997320","observation_id":"a9ece942-fad2-401d-96fb-e18ccaee898b","resolution":{"observed_at":"2026-08-16T11:58:24.880899Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.00661","last_updated":"2020-05-02T00:09:16Z","snapshot_observed_at":"2026-08-18T19:33:38.559641Z","submitted_at":"2020-05-02T00:09:16Z","title":"On Faithfulness and Factuality in Abstractive Summarization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.00661","snapshot_observed_at":"2026-08-16T11:58:21.971103Z","title":"On faithfulness and factuality in abstractive summarization","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.971103Z"},"links":{"cited_paper":"/paper/2005.00661","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:6b14b589cb16a1da696afacf0c0c1ba898ad4cdf50fb938df1d5da306e00f47f","observation_id":"be949c40-7407-4b62-8478-b54e02c474f8","resolution":{"observed_at":"2026-08-16T11:58:21.971103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-08-13T20:44:28.824685Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-16T11:58:21.975720Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.975720Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:3d03c014aa4dc192113fa7d6e4894b48b70d7a74635e974910ed46cd2c1f6f8b","observation_id":"7f49206f-21eb-4d9c-bce6-3d6833982653","resolution":{"observed_at":"2026-08-16T11:58:21.975720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.857828Z","title":"On calibration of modern neural networks","venue":null,"work_id":"6ac903e7-32da-439b-ad09-2ecc45fc0e1d","year":2017},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.037426Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:0cf2b14e92799c4c74b07db196d0b74d0a745be06270ecfa75a48c6d7f394898","observation_id":"00919fb0-35c5-49bc-aa7d-7cb4b5fe377f","resolution":{"observed_at":"2026-08-16T11:58:24.865031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-16T11:58:22.084913Z","title":"Step 1: Gather Datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.084913Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:f09e8c623c81d6339d5b09ef4906f569de106184f6144480e2a39c27bd2b22e9","observation_id":"2718f6db-b243-46e6-a41b-fcb11c49c3f4","resolution":{"observed_at":"2026-08-16T11:58:22.084913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.667482Z","title":"Diagnostic Accuracy","venue":null,"work_id":"e42b1964-d9f3-4154-8eba-b76703d8a14b","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.090442Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:16b855e80a9df8b8242b832e1ac19be7b68d7e1eb6ece47bb29349210352870c","observation_id":"c3402551-240f-4f79-9933-421fcf7501a1","resolution":{"observed_at":"2026-08-16T11:58:24.781221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.614565Z","title":"Temporal Consistency Score","venue":null,"work_id":"b4551f84-06f3-44e4-836f-0ae3cc773103","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.095190Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:e860350cd6fb017934bcb06c2ea3e257ff3536d86c653f05cb18e81dc70db431","observation_id":"09fd381e-7358-4c67-b390-de96d74b5a2e","resolution":{"observed_at":"2026-08-16T11:58:24.625652Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.592059Z","title":"Explainability Assessment","venue":null,"work_id":"0090c15a-a40c-4787-b3b7-799529f0ea45","year":2018},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.099989Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:8a87b5f02080c2ae86e8b30ee0cbed1487ee494475b068364429c1c8c827dd1f","observation_id":"76e053e4-e9d9-41e0-bc24-1db72b9fe0f1","resolution":{"observed_at":"2026-08-16T11:58:24.597310Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.567130Z","title":null,"venue":null,"work_id":"7632235f-565b-47ec-9422-f6d536211d05","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.106223Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:8af9387ab0c4027b61bb238dc675eb741cfcd1bf349bdb7a7210d6afb221bb55","observation_id":"e98d30c7-d718-4728-b474-f5f694ede798","resolution":{"observed_at":"2026-08-16T11:58:24.571375Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.544053Z","title":null,"venue":null,"work_id":"325039da-2957-49eb-b199-c331019a52a2","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.110710Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:52f5475a6a2f2e38e44625d90c4d5255e5abbd36dad8340cdf3961db62eb79c0","observation_id":"ef8977be-2378-4982-b600-9eeab933f65d","resolution":{"observed_at":"2026-08-16T11:58:24.553868Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.519477Z","title":"technology)","venue":null,"work_id":"3a22b4dd-691b-4e78-9521-0201f95c3616","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.150028Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:88c3c318712c35b83a9c61b79c6ea907eac92cc8ea1dec36f6aeb855206f15b2","observation_id":"5df5f245-a900-4ca4-98bb-24127b6a2c40","resolution":{"observed_at":"2026-08-16T11:58:24.523968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.493635Z","title":null,"venue":null,"work_id":"c69c7636-832f-4e38-9547-a5ba534e060b","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.218868Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:773e924c7e5ddc4e989dcd430eba377854d1c557bc7553b4a95e81db5694491f","observation_id":"6ddd717a-4995-4ea2-b591-4a3f9b8a4b4d","resolution":{"observed_at":"2026-08-16T11:58:24.499168Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.423728Z","title":"motivation_similarity","venue":null,"work_id":"031d8303-a453-44ff-b746-972ae932a33f","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.301848Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:ff71b7bcc06fd8a3f91fcb5810b0784734d48915bbaf566adc15aecb8510975c","observation_id":"6b79f5f4-d18e-449d-a69a-d3d2a6658d31","resolution":{"observed_at":"2026-08-16T11:58:24.473692Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.346458Z","title":null,"venue":null,"work_id":"9abed666-5b41-487c-b879-44162c91c684","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.308104Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:0b27080b2572c2c763a21e966e74793f0830b8f24ee3498962ea9de25670d01b","observation_id":"9569f231-2ada-49c7-a788-21028d82d285","resolution":{"observed_at":"2026-08-16T11:58:24.351567Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.208033Z","title":null,"venue":null,"work_id":"9b8e5487-74a1-46ae-97f3-264af9c22ac2","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.312767Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:04317d4fbfb707ad8d0023f269d6a1e7dfd0a286017812699fba812bd1fcce25","observation_id":"78c1a0f9-18ce-4174-8a28-a72441d78db7","resolution":{"observed_at":"2026-08-16T11:58:24.325439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.185636Z","title":null,"venue":null,"work_id":"3c0553c7-0e00-4462-a0b7-067fc62d6241","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.317520Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:63e12abef9d09d9749bae7ef7d23c96ec8c01c846c46eb28430a0b40749a22cd","observation_id":"26c0743f-210a-4ae4-befa-e2920d3f2170","resolution":{"observed_at":"2026-08-16T11:58:24.190753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.168155Z","title":null,"venue":null,"work_id":"b0648d2a-a676-4b47-b52c-0f64f1199dea","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.322448Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:803acc1de7e23069072eb8fb848514e527e61918d0ceaa24def4230bca5dc4bc","observation_id":"99c337f1-12eb-4e83-8dce-b470edcb66ee","resolution":{"observed_at":"2026-08-16T11:58:24.172813Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.065927Z","title":"experiment_plan_similarity","venue":null,"work_id":"d824039e-6910-48aa-8215-5bf38e4ac68e","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.328405Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:c093bb26b4420a6546f81f2f0b6e8b747764d1b9ed0708240b31efab38c73700","observation_id":"f06f6786-5f50-4140-85a1-e098c8114fdf","resolution":{"observed_at":"2026-08-16T11:58:24.070802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:24.050508Z","title":"The motivation does not address the topic, and the Experimental plan does not effectively test the research question posed","venue":null,"work_id":"07488b87-796d-4bdc-a900-f2ef51b1b77e","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.367463Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:cdf68b94ba4d13a5cde47475cdc40059a5b2e1284a63a4bc00512a30245666dd","observation_id":"9436f788-c9e6-417e-9e54-a0063c5c6a3e","resolution":{"observed_at":"2026-08-16T11:58:24.056131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:23.882290Z","title":"The motivation addresses the topic but in a vague or unclear manner, and the Experimental plan partially, but not effectively, tests the research question","venue":null,"work_id":"514a4459-122d-45dd-b4cf-dc27e9a0d55d","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.451053Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:3f8b0e8681a5b6e1ee99df5f7f2d77e68180db6173fe871f7193908b3e6ac0b6","observation_id":"bef90335-f4da-4e6e-9399-015b1f1d3b84","resolution":{"observed_at":"2026-08-16T11:58:23.951234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:23.864607Z","title":"The motivation explains the topic, but with some gaps in clarity, and the Experimental plan mostly addresses the research question, though some methods may not be optimal","venue":null,"work_id":"4e0ed043-11ce-462a-b888-e355b1d028e0","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.493236Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:91096e725e25f97282de37fea5c6fa67ea7eb82bce40a5329647479983e60a94","observation_id":"d4388bc4-8799-4600-ab88-b58dfbe44302","resolution":{"observed_at":"2026-08-16T11:58:23.870583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:23.700688Z","title":"The motivation explains the research problem well, and the Experimental plan is suitable and addresses the research question effectively","venue":null,"work_id":"c8df102e-8ff0-4b59-a7ca-d8eb7977f126","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.499245Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:ec13b8a1baff1e2d3dafb2e3b8eec4e4694ba93c28939bbdc88d7b26ac345773","observation_id":"d23691ea-e0e4-4a82-800f-daa7363563b1","resolution":{"observed_at":"2026-08-16T11:58:23.782717Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:23.685532Z","title":"motivation","venue":null,"work_id":"d2d8fa2c-fde1-463f-9130-7ceb7651eb98","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.503943Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:e619840bf65f56452c010889642b3fcbbd7f5ba47a1da60ba1e6957524a26c80","observation_id":"c1220d2f-484e-4e67-9c6f-c3b41805c268","resolution":{"observed_at":"2026-08-16T11:58:23.690220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:23.589482Z","title":null,"venue":null,"work_id":"7ede4746-4374-4236-9172-cd8e37552220","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.508648Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:342f694138d6d49adb7957e4c65cbd98db91ecd607edc1748715acefa0d16b7a","observation_id":"08a71801-7915-4512-8fde-405b48b7a238","resolution":{"observed_at":"2026-08-16T11:58:23.673227Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:23.506825Z","title":null,"venue":null,"work_id":"ecdb80b0-5f47-4f4e-ad39-9bbec64d987b","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.514352Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:5e074d9948fa7b360235550c370fe41887536d17216cb636811dba4dfea93d68","observation_id":"b463453e-6ace-41fa-87b3-73713eadb55d","resolution":{"observed_at":"2026-08-16T11:58:23.577337Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:23.409872Z","title":null,"venue":null,"work_id":"725930d4-a31c-4bb0-93c5-c7d5bd9b42f0","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.599114Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:022904075f73c2bf9a9d38182c04e160a83c1cc53036e1d3c50a50c6010f15c7","observation_id":"7e6fb919-cda7-4159-a4ef-58d557f56d2c","resolution":{"observed_at":"2026-08-16T11:58:23.415373Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:23.292731Z","title":null,"venue":null,"work_id":"fd87c174-b21a-43e5-b54a-e4adbdbff702","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.630312Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:51f5f28dae406158fbf73cc73a83a30f2422a78c000c32430113522144066061","observation_id":"503fa07c-36c8-42dc-816e-33a7cf32b01a","resolution":{"observed_at":"2026-08-16T11:58:23.372147Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:23.231843Z","title":null,"venue":null,"work_id":"78851f82-9e49-48a2-99ef-cd2461f43bcd","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.636590Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:9c0a973cd2b91231262b9bc0299958f7c897e7a59caf7d1c9bc0e78bad0f8003","observation_id":"a054e342-45dc-44cf-a196-f86824d900ca","resolution":{"observed_at":"2026-08-16T11:58:23.279910Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:23.180651Z","title":"Novelty_choice","venue":null,"work_id":"27aedef2-19b8-4aeb-a010-161e2e749fc5","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:22.641579Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:68869c431060e7f3566d6773077cdc52e1e933f21ff7d57b2165d4276ccc3641","observation_id":"faa00754-e390-4524-87df-4399f07e0a39","resolution":{"observed_at":"2026-08-16T11:58:23.216824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-16T11:58:25.706222Z","title":null,"venue":null,"work_id":"893db51c-e099-4978-bd52-6135e1ee8aea","year":null},"citing_paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-16T11:58:21.029193Z"},"links":{"citing_paper":"/paper/2504.14191"},"observation_digest":"sha256:f5289b0a946223d233bd804d93cc802d7783b331e771f9135a498d0386852fc4","observation_id":"ca06826d-62c4-424c-8eef-92a24b76925b","resolution":{"observed_at":"2026-08-16T11:58:25.711859Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2504.14191","last_updated":"2025-05-24T02:40:54Z","latest_version":3,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-18T19:38:07.784057Z","submitted_at":"2025-04-19T05:35:45Z","title":"AI Idea Bench 2025: AI Research Idea Generation Benchmark"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":29},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 14 inbound Pith citation observations for arXiv:2504.14191."}