Pith. sign in

Paper Citation Record · LEDGER

AI Idea Bench 2025: AI Research Idea Generation Benchmark

As of 20 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 14 inbound Pith citation observations for arXiv:2504.14191.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2504.14191 v3

Coverage vector

measured 75 of 75 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-16T11:58:22.641579Z

measured 89 of 89 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-20T06:33:59.587034+00:00

measured 14 of 14 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T16:07:42.694240Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-28T18:42:28.930343Z

Reference resolution

75 of 75 outbound references displayed

  • verified exact0
  • verified fuzzy29
  • unresolved46
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 08aed1e6-045d-4a6a-84b8-be6f3c03d13e · outbound

This paper cites GPT-4 Technical Report.

AI Idea Bench 2025: AI Research Idea Generation Benchmark GPT-4 Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:20.998095Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:20.998095Z digest=sha256:3f5b689e117bd9f4fea2f2b13d842bf622a2234ea2ce9fe8bd24650b96b5e9e8

Observation 7755de76-4627-43e3-8e9e-8218e2df43da · outbound

This paper cites The Llama 3 Herd of Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The Llama 3 Herd of Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.004385Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.004385Z digest=sha256:695a089f4acb77f66be4d6f73844c60244881a02c878a759c9a66a91e0042de7

Observation 7d1f7226-ff5a-4552-b6ce-858923073dbb · outbound

This paper cites Qwen2 Technical Report.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Qwen2 Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.009030Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.009030Z digest=sha256:bdebace31968270af66fb529858240968f5a0a3c6f3871c812f8fc57f41c1b28

Observation c91815cc-2dd1-41f5-9725-e6f567909811 · outbound

This paper cites DeepSeek-V3 Technical Report.

AI Idea Bench 2025: AI Research Idea Generation Benchmark DeepSeek-V3 Technical Report

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.013688Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.013688Z digest=sha256:a4fa3a4068cf76c21fb343d4852e0332f038461da3f8a0446649a74ba3e6c339

Observation 26871f81-af09-4a9f-8994-c599088c432d · outbound

This paper cites MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.019262Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.019262Z digest=sha256:96a3f1c01783fe3bc9669a1131fdad79eea84dcc2d5592c83b5625b00d63df80

Observation b62ff467-86f9-412a-bef8-ca3b4e4f7d20 · outbound

This paper cites Leandojo: Theorem proving with retrieval-augmented language models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Leandojo: Theorem proving with retrieval-augmented language models

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.808071Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.024473Z digest=sha256:5b9ffa58c4b43ab02b38cdeef09241cd899b8db750a98f40d6497bd93a9643e8

Observation 6bc73ca2-bf08-4896-a0c2-4030bb0a283e · outbound

This paper cites Evaluating Large Language Models Trained on Code.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Evaluating Large Language Models Trained on Code

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.033768Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.033768Z digest=sha256:5af4984cd81d1ad0bf5c32417f7800e455314ec0ab3a464ba70172f62d5543d0

Observation 52a620fe-45f9-4067-8ec1-7759258d388f · outbound

This paper cites The Impact of Large Language Models on Scientific Discovery: a Preliminary Study using GPT-4.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The Impact of Large Language Models on Scientific Discovery: a Preliminary Study using GPT-4

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.039778Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.039778Z digest=sha256:33ffb5d71f218b624e910f6a2da1fc0fc7740de85cee083717be8294e698c1cc

Observation 509c5a05-cbc5-4a57-9d6e-e6d9f57ccac1 · outbound

This paper cites Large Language Models for Automated Open-domain Scientific Hypotheses Discovery.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Large Language Models for Automated Open-domain Scientific Hypotheses Discovery

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.044920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.044920Z digest=sha256:e97f2c72cafd1ee8219c962ca66d0c7f8e353d98398a7018711e89623dc934a9

Observation c3819d28-3566-4dcc-96f6-c72bd19b4df9 · outbound

This paper cites SciMON: Scientific Inspiration Machines Optimized for Novelty.

AI Idea Bench 2025: AI Research Idea Generation Benchmark SciMON: Scientific Inspiration Machines Optimized for Novelty

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.049231Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.049231Z digest=sha256:35002ed38f65a88dcf0b6a832b76056c68f8ffdbc81ddaf5dfdcd26c9d5fdf92

Observation 5a1e522a-9c43-4f05-a897-ba7929f0bf36 · outbound

This paper cites Hypothesis Generation with Large Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Hypothesis Generation with Large Language Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.053610Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.053610Z digest=sha256:8e43614a76fe91c7888c9983794e3489b4b57bd9972f37f61f8281ef5fd5c3be

Observation b28058be-e15b-4d72-a911-49d96a05c0b5 · outbound

This paper cites ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.157138Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.157138Z digest=sha256:c3725a25e112e71756e504cdd52d67f3cea920a108e5788dfc03d628728b97dc

Observation 1c10d555-bd33-4690-b383-d07ec364fdd1 · outbound

This paper cites Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.203000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.203000Z digest=sha256:b924efb0eff8a8e364e3ff5301692d9d298e6fda7688c5efa0512b3bae0c582e

Observation 5ef1136c-b052-4631-b15b-59ce40ba009a · outbound

This paper cites IdeaBench: Benchmarking Large Language Models for Research Idea Generation.

AI Idea Bench 2025: AI Research Idea Generation Benchmark IdeaBench: Benchmarking Large Language Models for Research Idea Generation

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.208391Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.208391Z digest=sha256:d8302996056081cd6fe885660b845de17eba5bfe9e2dd0b011321ab5c1bc2d41

Observation f0577212-6a73-4d0a-9d16-f8a39968722a · outbound

This paper cites The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.212918Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.212918Z digest=sha256:572331cd2e335ae6ec55a0bbea6c07639ca6ab1c0e0553d41f586b0b77d956f6

Observation 8a949227-e4b7-4ed9-ac30-22a72635fa55 · outbound

This paper cites Mlr-copilot: Autonomous machine learning research based on large language models agents.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Mlr-copilot: Autonomous machine learning research based on large language models agents

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.217865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.217865Z digest=sha256:1768025a2167bb4f9aa8a0c8ad8a39c36906c64d5241cc658febd6839c5e7f1c

Observation 99aed0dd-00e2-44c8-be33-d77df387b0bf · outbound

This paper cites Nova: An Iterative Planning and Search Approach to Enhance Novelty and Diversity of LLM Generated Ideas.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Nova: An Iterative Planning and Search Approach to Enhance Novelty and Diversity of LLM Generated Ideas

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.223288Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.223288Z digest=sha256:742e7cbe6d2fbe8381de1f977c97549679c329b09a39560a73577b2881e8a756

Observation d84fd79f-8995-467c-b846-7d34f410f312 · outbound

This paper cites SciPIP: An LLM-based Scientific Paper Idea Proposer.

AI Idea Bench 2025: AI Research Idea Generation Benchmark SciPIP: An LLM-based Scientific Paper Idea Proposer

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.229759Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.229759Z digest=sha256:8c4cdc86923e8f90bfaa5334af51fc5f6a6b75911d26e978bc0418c1e50d5742

Observation 51f4c60a-42da-433e-8b1a-90bf73520251 · outbound

This paper cites Many Heads Are Better Than One: Improved Scientific Idea Generation by A LLM-Based Multi-Agent System.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Many Heads Are Better Than One: Improved Scientific Idea Generation by A LLM-Based Multi-Agent System

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.315863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.315863Z digest=sha256:1ea128908ff494fb9dc8ee1ae9e28dbfb46c889282effabfa119203cda5204d6

Observation 6086f1bf-05d7-4b24-8136-1e93589b7198 · outbound

This paper cites Chain of Ideas: Revolutionizing Research Via Novel Idea Development with LLM Agents.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Chain of Ideas: Revolutionizing Research Via Novel Idea Development with LLM Agents

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.363302Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.363302Z digest=sha256:3f9e44140e0fba18f277c70640d7e133df5b552aabecd5ec166cad8865d0bbe1

Observation 4f4bcc7b-1d31-4a35-887a-b2f34f469ef2 · outbound

This paper cites Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.369684Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.369684Z digest=sha256:29425a4e8b6bcbabdcb53f25323e4edccceef81cf693f80ae6d7711eafe36f63

Observation 62e9133f-e188-4e26-b37e-6cfe68e63afc · outbound

This paper cites Openess: Event- based semantic scene understanding with open vocabularies.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Openess: Event- based semantic scene understanding with open vocabularies

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.687810Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.375055Z digest=sha256:0d90f1597f7f2d96fbbc07acd135be48ce8c7367108fb598c480a5e4909d1618

Observation a1e7d3b6-66eb-45b9-b8f5-6d1784038c4e · outbound

This paper cites Learning transferable visual models from natural language supervision.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Learning transferable visual models from natural language supervision

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.380476Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.380476Z digest=sha256:5d6bb63fbb1ad4a2a1ca5fc2ed9b2faa570ec130fc17f54ca05afb66b9a61084

Observation 303a0ea5-f156-4304-b424-70d7584571a6 · outbound

This paper cites Ev-segnet: Semantic segmentation for event-based cameras.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Ev-segnet: Semantic segmentation for event-based cameras

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.644539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.386025Z digest=sha256:3577297638dcb1dc011752313feb2fd930cd71772f7bf0e0ce49f16acf2a8fca

Observation f6696076-6742-4b3f-a8f9-3bfd46bd941d · outbound

This paper cites Event-based vision: A survey.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Event-based vision: A survey

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.626938Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.492678Z digest=sha256:ca1a4815e549ad164a7cb679165891f6560f4df40822f376a971456700500f7a

Observation b46b5ac7-7877-40c8-9865-65b48091229b · outbound

This paper cites Ess: Learning event-based semantic segmentation from still images.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Ess: Learning event-based semantic segmentation from still images

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.505728Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.599354Z digest=sha256:28698e2448175ffe9ce99e28121782c6191d72b39003a26952a00252e331ee51

Observation 8916e62d-2a8a-45fd-bda3-9ab0d379cd0e · outbound

This paper cites Slic superpixels compared to state-of-the-art superpixel methods.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Slic superpixels compared to state-of-the-art superpixel methods

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.603879Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.603879Z digest=sha256:7a35170c3cb57d6b58bcc9ca087784113482c3a5f805a49a81a6df376b9e7cf3

Observation 57b1e4cb-25fa-48c4-b885-3b7febf057de · outbound

This paper cites Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.609118Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.609118Z digest=sha256:9d84e63b47ec359c6dbef2870f0c871bcbb505ace5c55b0e9ab83cd7111b2829

Observation fdc35fbf-1454-40ba-9e94-31677db8ce6e · outbound

This paper cites Chain-of-thought prompting elicits reasoning in large language models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Chain-of-thought prompting elicits reasoning in large language models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.613913Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.613913Z digest=sha256:282d2cd17e84189d7d412d852fb917b50c23fa91df6b054176b7a1cabacad069

Observation 7f86ebcb-470a-422c-bdc1-19617311a48f · outbound

This paper cites Tree of thoughts: Deliberate problem solving with large language models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Tree of thoughts: Deliberate problem solving with large language models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.618198Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.618198Z digest=sha256:15bcd2038e567ee3e68ec30d29589e3e3523979c7235d272a92dda95fc93c91e

Observation 7a8d405e-fabf-4a55-8c8b-7710e6dc0306 · outbound

This paper cites ExpertPrompting: Instructing Large Language Models to be Distinguished Experts.

AI Idea Bench 2025: AI Research Idea Generation Benchmark ExpertPrompting: Instructing Large Language Models to be Distinguished Experts

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.622708Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.622708Z digest=sha256:e04dd334e623c4ea2d667375b45d5873385158da9daffc4dd32a5d16cce7e7a9

Observation d65cd50e-bc0b-4970-82e7-79518ca618ce · outbound

This paper cites Pal: Program-aided language models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Pal: Program-aided language models

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.326711Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.676417Z digest=sha256:9bba2c689405e2f105f5bfe4f843870d95728e364b95103667b92bdca004bd08

Observation ffb3e6e1-411d-49d2-9384-328769ad5be5 · outbound

This paper cites Self-Consistency Improves Chain of Thought Reasoning in Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Self-Consistency Improves Chain of Thought Reasoning in Language Models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.746473Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.746473Z digest=sha256:b0fe30a8c725f7164e78c9f327c98a675a103897fae0b8f3d3b4e2d20b3647ad

Observation 61e191ab-ba7f-48da-9e9c-bfd5dffc7ae4 · outbound

This paper cites Large language models are few-shot clinical information extractors.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Large language models are few-shot clinical information extractors

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.305432Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.751380Z digest=sha256:6fb8d1d49e1a07fa6d2122703cf72aa328f251f9cbe46821ce14f2d7d1d974f1

Observation 4b2e03f1-4830-4917-9a61-1b2e0ff17c81 · outbound

This paper cites Nlice: Synthetic medical record generation for effective primary healthcare differential diagnosis.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Nlice: Synthetic medical record generation for effective primary healthcare differential diagnosis

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.263947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.756308Z digest=sha256:5e50ee610fc46350b3f5922579742eb50312b343f309d1cde9c8c9bd812dbf50

Observation 58fdba56-8f57-4607-bb6d-751d33fa42cd · outbound

This paper cites Ehrxqa: A multi-modal question answering dataset for electronic health records with chest x-ray images.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Ehrxqa: A multi-modal question answering dataset for electronic health records with chest x-ray images

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.191937Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.760736Z digest=sha256:01d9a5b9dac57bc6941bb1ac840935b2cc1fc7a9f960ed51bfab4f5bbbdfc762

Observation bb158785-13c0-4b9e-b35d-1b7cdc42d9da · outbound

This paper cites Comparative accuracy of diagnosis by collective intelligence of multiple physicians vs individual physicians.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Comparative accuracy of diagnosis by collective intelligence of multiple physicians vs individual physicians

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.143659Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.765493Z digest=sha256:b3e2e7a8a96fd8c4627128d56fff7991ef1f5a8b648d76ec393b942087a9d2b2

Observation baf43570-f2e5-4604-9eed-28faff588fa0 · outbound

This paper cites The use of analytic hierarchy process for measuring the complexity of medical diagnosis.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The use of analytic hierarchy process for measuring the complexity of medical diagnosis

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.073329Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.770723Z digest=sha256:3c1bf69270c35390c513dc669faaea4b227cac83b01651310e1fb0118451646b

Observation b45a8295-e1a0-4ec1-8c50-d5651012a67c · outbound

This paper cites Koala: Key frame-conditioned long video-llm.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Koala: Key frame-conditioned long video-llm

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.947731Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.775364Z digest=sha256:d16135b38522ef3470e04be3f6f7faf41bc065551ea5b2be50df9f8a1b881646

Observation 21b4328b-8c1b-40c2-aa7c-5b9bd622ff47 · outbound

This paper cites VideoChat: Chat-Centric Video Understanding.

AI Idea Bench 2025: AI Research Idea Generation Benchmark VideoChat: Chat-Centric Video Understanding

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.780047Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.780047Z digest=sha256:7c9911a07d7986524d34b3ecf03186cb29664494716b29814d522bff81b35d70

Observation 9d1a3d3c-65ff-4dec-afce-9efe504630a2 · outbound

This paper cites Egoschema: A diagnostic benchmark for very long-form video language understanding.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Egoschema: A diagnostic benchmark for very long-form video language understanding

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.933636Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.905401Z digest=sha256:5c5780a4100ac06440d964bf1dd55298641df286b89025ab8114c820eb2be846

Observation 726d7a34-d195-4694-abe2-1bf9e8c08e4e · outbound

This paper cites Howto100m: Learning a text-video embedding by watching hundred million narrated video clips.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Howto100m: Learning a text-video embedding by watching hundred million narrated video clips

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.946871Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.946871Z digest=sha256:625c6d9b34b0e50405c4c07c8adb664772f3165aad265e17dea5a7bf72ccffb3

Observation 5137740b-5826-48e6-94e9-1b6820ff0d72 · outbound

This paper cites Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.952993Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.952993Z digest=sha256:bd224bc480eaa766f655feb925b22d29267e1fc4679d6ffec1b8746e7badf1c4

Observation 4751138d-ce50-438e-bf3d-e931aebdb1ba · outbound

This paper cites Fine-grained cross-view geo- localization using a correlation-aware homography estimator.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Fine-grained cross-view geo- localization using a correlation-aware homography estimator

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.909355Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.957771Z digest=sha256:9db2804afdfa7cba8f36d875b6211efa5659bbb2d100d236ca4610b7e4ebf575

Observation 79a11e85-f7ee-41ae-860a-0da46d93c6c7 · outbound

This paper cites R-tuning: Instructing large language models to say ‘i don’t know’.

AI Idea Bench 2025: AI Research Idea Generation Benchmark R-tuning: Instructing large language models to say ‘i don’t know’

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.895141Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.962704Z digest=sha256:861d69baee41ed6d071cfd0391e35a384d4f1fabc72b325b00f5c28ab0441bf6

Observation a9ece942-fad2-401d-96fb-e18ccaee898b · outbound

This paper cites Selfcheckgpt: Zero-resource black-box hallucination detection for generative large language models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Selfcheckgpt: Zero-resource black-box hallucination detection for generative large language models

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.880899Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.967058Z digest=sha256:60046806022eb4f80c79e013d9673c46be1c56ce81bcee64b7b8e404f1997320

Observation be949c40-7407-4b62-8478-b54e02c474f8 · outbound

This paper cites On Faithfulness and Factuality in Abstractive Summarization.

AI Idea Bench 2025: AI Research Idea Generation Benchmark On Faithfulness and Factuality in Abstractive Summarization

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.971103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.971103Z digest=sha256:6b14b589cb16a1da696afacf0c0c1ba898ad4cdf50fb938df1d5da306e00f47f

Observation 7f49206f-21eb-4d9c-bce6-3d6833982653 · outbound

This paper cites Measuring Massive Multitask Language Understanding.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Measuring Massive Multitask Language Understanding

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.975720Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.975720Z digest=sha256:3d03c014aa4dc192113fa7d6e4894b48b70d7a74635e974910ed46cd2c1f6f8b

Observation 00919fb0-35c5-49bc-aa7d-7cb4b5fe377f · outbound

This paper cites On calibration of modern neural networks.

AI Idea Bench 2025: AI Research Idea Generation Benchmark On calibration of modern neural networks

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.865031Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.037426Z digest=sha256:0cf2b14e92799c4c74b07db196d0b74d0a745be06270ecfa75a48c6d7f394898

Observation 2718f6db-b243-46e6-a41b-fcb11c49c3f4 · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark LLaMA: Open and Efficient Foundation Language Models

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:22.084913Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:22.084913Z digest=sha256:f09e8c623c81d6339d5b09ef4906f569de106184f6144480e2a39c27bd2b22e9

Observation c3402551-240f-4f79-9933-421fcf7501a1 · outbound

This paper cites Diagnostic Accuracy.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Diagnostic Accuracy

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.781221Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.090442Z digest=sha256:16b855e80a9df8b8242b832e1ac19be7b68d7e1eb6ece47bb29349210352870c

Observation 09fd381e-7358-4c67-b390-de96d74b5a2e · outbound

This paper cites Temporal Consistency Score.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Temporal Consistency Score

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.625652Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.095190Z digest=sha256:e860350cd6fb017934bcb06c2ea3e257ff3536d86c653f05cb18e81dc70db431

Observation 76e053e4-e9d9-41e0-bc24-1db72b9fe0f1 · outbound

This paper cites Explainability Assessment.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Explainability Assessment

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.597310Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.099989Z digest=sha256:8a87b5f02080c2ae86e8b30ee0cbed1487ee494475b068364429c1c8c827dd1f

Observation e98d30c7-d718-4728-b474-f5f694ede798 · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 55

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.571375Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.106223Z digest=sha256:8af9387ab0c4027b61bb238dc675eb741cfcd1bf349bdb7a7210d6afb221bb55

Observation ef8977be-2378-4982-b600-9eeab933f65d · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 56

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.553868Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.110710Z digest=sha256:52f5475a6a2f2e38e44625d90c4d5255e5abbd36dad8340cdf3961db62eb79c0

Observation 5df5f245-a900-4ca4-98bb-24127b6a2c40 · outbound

This paper cites technology).

AI Idea Bench 2025: AI Research Idea Generation Benchmark technology)

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.523968Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.150028Z digest=sha256:88c3c318712c35b83a9c61b79c6ea907eac92cc8ea1dec36f6aeb855206f15b2

Observation 6ddd717a-4995-4ea2-b591-4a3f9b8a4b4d · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 58

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.499168Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.218868Z digest=sha256:773e924c7e5ddc4e989dcd430eba377854d1c557bc7553b4a95e81db5694491f

Observation 6b79f5f4-d18e-449d-a69a-d3d2a6658d31 · outbound

This paper cites motivation_similarity.

AI Idea Bench 2025: AI Research Idea Generation Benchmark motivation_similarity

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.473692Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.301848Z digest=sha256:ff71b7bcc06fd8a3f91fcb5810b0784734d48915bbaf566adc15aecb8510975c

Observation 9569f231-2ada-49c7-a788-21028d82d285 · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 60

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.351567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.308104Z digest=sha256:0b27080b2572c2c763a21e966e74793f0830b8f24ee3498962ea9de25670d01b

Observation 78c1a0f9-18ce-4174-8a28-a72441d78db7 · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 61

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.325439Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.312767Z digest=sha256:04317d4fbfb707ad8d0023f269d6a1e7dfd0a286017812699fba812bd1fcce25

Observation 26c0743f-210a-4ae4-befa-e2920d3f2170 · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 62

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.190753Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.317520Z digest=sha256:63e12abef9d09d9749bae7ef7d23c96ec8c01c846c46eb28430a0b40749a22cd

Observation 99c337f1-12eb-4e83-8dce-b470edcb66ee · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 63

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.172813Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.322448Z digest=sha256:803acc1de7e23069072eb8fb848514e527e61918d0ceaa24def4230bca5dc4bc

Observation f06f6786-5f50-4140-85a1-e098c8114fdf · outbound

This paper cites experiment_plan_similarity.

AI Idea Bench 2025: AI Research Idea Generation Benchmark experiment_plan_similarity

Reference 64

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.070802Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.328405Z digest=sha256:c093bb26b4420a6546f81f2f0b6e8b747764d1b9ed0708240b31efab38c73700

Observation 9436f788-c9e6-417e-9e54-a0063c5c6a3e · outbound

This paper cites The motivation does not address the topic, and the Experimental plan does not effectively test the research question posed.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The motivation does not address the topic, and the Experimental plan does not effectively test the research question posed

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.056131Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.367463Z digest=sha256:cdf68b94ba4d13a5cde47475cdc40059a5b2e1284a63a4bc00512a30245666dd

Observation bef90335-f4da-4e6e-9399-015b1f1d3b84 · outbound

This paper cites The motivation addresses the topic but in a vague or unclear manner, and the Experimental plan partially, but not effectively, tests the research question.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The motivation addresses the topic but in a vague or unclear manner, and the Experimental plan partially, but not effectively, tests the research question

Reference 66

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:23.951234Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.451053Z digest=sha256:3f8b0e8681a5b6e1ee99df5f7f2d77e68180db6173fe871f7193908b3e6ac0b6

Observation d4388bc4-8799-4600-ab88-b58dfbe44302 · outbound

This paper cites The motivation explains the topic, but with some gaps in clarity, and the Experimental plan mostly addresses the research question, though some methods may not be optimal.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The motivation explains the topic, but with some gaps in clarity, and the Experimental plan mostly addresses the research question, though some methods may not be optimal

Reference 67

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:23.870583Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.493236Z digest=sha256:91096e725e25f97282de37fea5c6fa67ea7eb82bce40a5329647479983e60a94

Observation d23691ea-e0e4-4a82-800f-daa7363563b1 · outbound

This paper cites The motivation explains the research problem well, and the Experimental plan is suitable and addresses the research question effectively.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The motivation explains the research problem well, and the Experimental plan is suitable and addresses the research question effectively

Reference 68

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:23.782717Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.499245Z digest=sha256:ec13b8a1baff1e2d3dafb2e3b8eec4e4694ba93c28939bbdc88d7b26ac345773

Observation c1220d2f-484e-4e67-9c6f-c3b41805c268 · outbound

This paper cites motivation.

AI Idea Bench 2025: AI Research Idea Generation Benchmark motivation

Reference 69

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:23.690220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.503943Z digest=sha256:e619840bf65f56452c010889642b3fcbbd7f5ba47a1da60ba1e6957524a26c80

Observation 08a71801-7915-4512-8fde-405b48b7a238 · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 70

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:23.673227Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.508648Z digest=sha256:342f694138d6d49adb7957e4c65cbd98db91ecd607edc1748715acefa0d16b7a

Observation b463453e-6ace-41fa-87b3-73713eadb55d · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 71

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:23.577337Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.514352Z digest=sha256:5e074d9948fa7b360235550c370fe41887536d17216cb636811dba4dfea93d68

Observation 7e6fb919-cda7-4159-a4ef-58d557f56d2c · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 72

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:23.415373Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.599114Z digest=sha256:022904075f73c2bf9a9d38182c04e160a83c1cc53036e1d3c50a50c6010f15c7

Observation 503fa07c-36c8-42dc-816e-33a7cf32b01a · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 73

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:23.372147Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.630312Z digest=sha256:51f5f28dae406158fbf73cc73a83a30f2422a78c000c32430113522144066061

Observation a054e342-45dc-44cf-a196-f86824d900ca · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 74

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:23.279910Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.636590Z digest=sha256:9c0a973cd2b91231262b9bc0299958f7c897e7a59caf7d1c9bc0e78bad0f8003

Observation faa00754-e390-4524-87df-4399f07e0a39 · outbound

This paper cites Novelty_choice.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Novelty_choice

Reference 75

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:23.216824Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:22.641579Z digest=sha256:68869c431060e7f3566d6773077cdc52e1e933f21ff7d57b2165d4276ccc3641

Observation ca06826d-62c4-424c-8eef-92a24b76925b · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 2023

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:25.711859Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-08-16T11:58:21.029193Z digest=sha256:f5289b0a946223d233bd804d93cc802d7783b331e771f9135a498d0386852fc4

Pith citing papers

Observation 5d9e6f68-d8a6-4da0-8dbe-6e1b3a893f03 · inbound

InternAgent: When Agent Becomes the Scientist -- Building Closed-Loop System from Hypothesis to Verification cites this paper.

InternAgent: When Agent Becomes the Scientist -- Building Closed-Loop System from Hypothesis to Verification AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T14:56:35.190567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:56:35.190567Z digest=sha256:fd0010507bc695477d16ff7b07b2014513a2f931b37db04ce2039b22887d8bb4

Observation 4bc94ee8-8935-44bc-8ef0-b686a58b9cf7 · inbound

Creativity in LLM-based Multi-Agent Systems: A Survey cites this paper.

Creativity in LLM-based Multi-Agent Systems: A Survey AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T13:43:22.887540Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:43:22.887540Z digest=sha256:50c3268853ce54749acc634dc7e340614797770867433716855b9ed2d16c5ca6

Observation b63b174f-8a0e-4df4-9e7e-d8c29bbf389b · inbound

SafeScientist: Toward Risk-Aware Scientific Discoveries by LLM Agents cites this paper.

SafeScientist: Toward Risk-Aware Scientific Discoveries by LLM Agents AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T12:46:29.896693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:46:29.896693Z digest=sha256:f72b6b9ca1d3e59f7550dd39edfeebbf0dbb931acfb0805ad19cc7555d891f02

Observation 0ce9a3a5-961c-4ee4-b7ea-01e36e925df1 · inbound

AD-Bench: A Real-World, Trajectory-Aware Advertising Analytics Benchmark for LLM Agents cites this paper.

AD-Bench: A Real-World, Trajectory-Aware Advertising Analytics Benchmark for LLM Agents AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-02T23:19:15.220053Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T23:19:15.220053Z digest=sha256:7e8c049bde7de2046305b510ad6aeb260c438e17b752397c02182cdce3542037

Observation 8add1d33-042d-49c4-8709-cb9ed2737f75 · inbound

SciDER: Scientific Data-centric End-to-end Researcher cites this paper.

SciDER: Scientific Data-centric End-to-end Researcher AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T19:41:50.287221Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T19:41:50.287221Z digest=sha256:70653cc776c29c935c3b86b68a0b4168e59e6fb79e235afaa5bac15532a5305b

Observation f1e60427-4787-4325-8b27-cb5a7741c716 · inbound

Intern-Atlas: A Methodological Evolution Graph as Research Infrastructure for AI Scientists cites this paper.

Intern-Atlas: A Methodological Evolution Graph as Research Infrastructure for AI Scientists AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 27

Resolution
metadata mismatch
arxiv_id, observed 2026-05-12T10:16:28.564631Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-07T06:42:17.145367Z digest=sha256:15880d86c9ac866a64252d7b9a33176118d2ab3954854ed631cd5304444d67ae

Observation abd265d6-0fff-44f7-a8db-07eff9a7cf2f · inbound

Evolving Idea Graphs with Learnable Edits-and-Commits for Multi-Agent Scientific Ideation cites this paper.

Evolving Idea Graphs with Learnable Edits-and-Commits for Multi-Agent Scientific Ideation AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 9

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T18:36:06.848758Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-08T15:34:46.766866Z digest=sha256:46dfafc01dcf25fb5bd743b6271465f6cc199394484bbd7ac04c57e62822a63f

Observation 71594fa6-0b39-467d-a124-ec2601e58981 · inbound

MLReplicate: Benchmarking Autonomous Research Systems for Machine Learning Reproducibility cites this paper.

MLReplicate: Benchmarking Autonomous Research Systems for Machine Learning Reproducibility AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 26

Resolution
verified exact
arxiv_id, observed 2026-05-20T20:03:43.974081Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-20T19:59:40.519962Z digest=sha256:ca9bb85b3af5994534837ab3e38dbc84879bba0dff8092a024a6f840faae749d

Observation 2b08c58d-21ba-43ef-bb78-325484a96e30 · inbound

AI for Auto-Research: Roadmap & User Guide cites this paper.

AI for Auto-Research: Roadmap & User Guide AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 154

Resolution
verified exact
arxiv_id, observed 2026-05-20T10:33:12.456178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=pdf_text observed=2026-05-20T10:30:50.256635Z digest=sha256:7b7e03f0b199152634b2b1ec1025bdd9721bda0a3e5703d9af985e846a58f9ec

Observation fa165538-f407-4df4-979c-dd555cd76d2c · inbound

AI for Auto-Research: Roadmap & User Guide cites this paper.

AI for Auto-Research: Roadmap & User Guide AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 154

Resolution
unresolved
no resolver link, observed 2026-08-02T13:43:42.447834Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T13:43:42.447834Z digest=sha256:6e269ec1c7d15310cec3b19ad0977b14adb9bebe23350e66d2c9fb423464d371

Observation 65f774b2-fc6b-47d6-babe-b801240feb91 · inbound

IDEAFix: Evaluation Framework for Creative Defixation Prompting in LLMs cites this paper.

IDEAFix: Evaluation Framework for Creative Defixation Prompting in LLMs AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 5

Resolution
metadata mismatch
arxiv_id, observed 2026-06-28T18:42:28.931783Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.

source=arxiv_source observed=2026-06-28T18:42:00.845492Z digest=sha256:a2714c5535a0e68c0ec8d741098092e9cae2fd161101e3388506b1d3e8e81d95

Observation 7089f488-7244-44b6-b19f-033139c1cbef · inbound

ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes cites this paper.

ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 36

Resolution
unresolved
no resolver link, observed 2026-07-11T19:11:37.739920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-11T19:11:37.739920Z digest=sha256:ee2d50805ab59c0595511f86b37e6b04a7d6a0de5a8ab4ea80d92d15ae57d2bc

Observation 552513ba-3072-4de0-9893-a9fa6b36bb6f · inbound

Tree-of-Ideas: Automated Research Ideation via Cross-Trajectory Reasoning over Scholarly Evolution cites this paper.

Tree-of-Ideas: Automated Research Ideation via Cross-Trajectory Reasoning over Scholarly Evolution AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-12T18:21:41.261437Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:21:41.261437Z digest=sha256:06716be4e9a6b6145c827c85a876770c41c94e211fb48f763d7f5882d8258e41

Observation 21dc9f61-24d9-4954-a9f2-80e9d54ba09b · inbound

LigBench: A Unified and Human-Aligned Benchmark for LLM-based Research Idea Generation cites this paper.

LigBench: A Unified and Human-Aligned Benchmark for LLM-based Research Idea Generation AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-15T16:07:42.694240Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T16:07:42.694240Z digest=sha256:c46c4d41de654fc8d6a89a1fc4965711eec4d29ec2a951e35c054e6f066f0d49