Pith. sign in

Paper Citation Record · LEDGER

AI Idea Bench 2025: AI Research Idea Generation Benchmark

As of 23 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 14 inbound Pith citation observations for arXiv:2504.14191.

A citation records a reference. It does not transfer a finding from one paper to another.

pith.paper-citation-record.v1
2504.14191 v3

Coverage vector

measured 75 of 75 reference resolution

Typed states for the displayed outbound observations.

Source: paper_references, paper_reference_links, observed 2026-08-16T11:58:22.641579Z

measured 89 of 89 standing notices

One-hop event checks from named stored sources.

Source: scholarly_work_events, retraction_status_cache, observed 2026-08-23T06:30:58.430688+00:00

measured 14 of 14 inbound itemization

Pith citing papers itemized under the disclosed page cap.

Source: paper_references, paper_reference_links, observed 2026-08-15T16:07:42.694240Z

measured 0 of 1 external citation measurements

A source-named dated measurement, never combined with another source.

Source: arxiv_reference, observed 2026-06-28T18:42:28.930343Z

Reference resolution

75 of 75 outbound references displayed

  • verified exact0
  • verified fuzzy29
  • unresolved46
  • parse uncertain0
  • malformed identifier0
  • metadata mismatch0

External citation measurements

No source-named external measurement is stored.

Outbound references

Observation 08aed1e6-045d-4a6a-84b8-be6f3c03d13e · outbound

This paper cites GPT-4 Technical Report.

AI Idea Bench 2025: AI Research Idea Generation Benchmark GPT-4 Technical Report

Reference 1

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:20.998095Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:20.998095Z digest=sha256:3f5b689e117bd9f4fea2f2b13d842bf622a2234ea2ce9fe8bd24650b96b5e9e8

Observation 7755de76-4627-43e3-8e9e-8218e2df43da · outbound

This paper cites The Llama 3 Herd of Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The Llama 3 Herd of Models

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.004385Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.004385Z digest=sha256:695a089f4acb77f66be4d6f73844c60244881a02c878a759c9a66a91e0042de7

Observation 7d1f7226-ff5a-4552-b6ce-858923073dbb · outbound

This paper cites Qwen2 Technical Report.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Qwen2 Technical Report

Reference 3

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.009030Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.009030Z digest=sha256:bdebace31968270af66fb529858240968f5a0a3c6f3871c812f8fc57f41c1b28

Observation c91815cc-2dd1-41f5-9725-e6f567909811 · outbound

This paper cites DeepSeek-V3 Technical Report.

AI Idea Bench 2025: AI Research Idea Generation Benchmark DeepSeek-V3 Technical Report

Reference 4

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.013688Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.013688Z digest=sha256:a4fa3a4068cf76c21fb343d4852e0332f038461da3f8a0446649a74ba3e6c339

Observation 26871f81-af09-4a9f-8994-c599088c432d · outbound

This paper cites MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark MetaMath: Bootstrap Your Own Mathematical Questions for Large Language Models

Reference 5

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.019262Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.019262Z digest=sha256:96a3f1c01783fe3bc9669a1131fdad79eea84dcc2d5592c83b5625b00d63df80

Observation b62ff467-86f9-412a-bef8-ca3b4e4f7d20 · outbound

This paper cites Leandojo: Theorem proving with retrieval-augmented language models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Leandojo: Theorem proving with retrieval-augmented language models

Reference 6

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.808071Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.024473Z digest=sha256:21aa8052fa26595f50d91622be75378c95199fd000b068bcce3ac8c5dca84dd2

Observation 6bc73ca2-bf08-4896-a0c2-4030bb0a283e · outbound

This paper cites Evaluating Large Language Models Trained on Code.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Evaluating Large Language Models Trained on Code

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.033768Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.033768Z digest=sha256:5af4984cd81d1ad0bf5c32417f7800e455314ec0ab3a464ba70172f62d5543d0

Observation 52a620fe-45f9-4067-8ec1-7759258d388f · outbound

This paper cites The Impact of Large Language Models on Scientific Discovery: a Preliminary Study using GPT-4.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The Impact of Large Language Models on Scientific Discovery: a Preliminary Study using GPT-4

Reference 8

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.039778Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.039778Z digest=sha256:33ffb5d71f218b624e910f6a2da1fc0fc7740de85cee083717be8294e698c1cc

Observation 509c5a05-cbc5-4a57-9d6e-e6d9f57ccac1 · outbound

This paper cites Large Language Models for Automated Open-domain Scientific Hypotheses Discovery.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Large Language Models for Automated Open-domain Scientific Hypotheses Discovery

Reference 9

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.044920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.044920Z digest=sha256:e97f2c72cafd1ee8219c962ca66d0c7f8e353d98398a7018711e89623dc934a9

Observation c3819d28-3566-4dcc-96f6-c72bd19b4df9 · outbound

This paper cites SciMON: Scientific Inspiration Machines Optimized for Novelty.

AI Idea Bench 2025: AI Research Idea Generation Benchmark SciMON: Scientific Inspiration Machines Optimized for Novelty

Reference 10

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.049231Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.049231Z digest=sha256:35002ed38f65a88dcf0b6a832b76056c68f8ffdbc81ddaf5dfdcd26c9d5fdf92

Observation 5a1e522a-9c43-4f05-a897-ba7929f0bf36 · outbound

This paper cites Hypothesis Generation with Large Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Hypothesis Generation with Large Language Models

Reference 11

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.053610Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.053610Z digest=sha256:8e43614a76fe91c7888c9983794e3489b4b57bd9972f37f61f8281ef5fd5c3be

Observation b28058be-e15b-4d72-a911-49d96a05c0b5 · outbound

This paper cites ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark ResearchAgent: Iterative Research Idea Generation over Scientific Literature with Large Language Models

Reference 12

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.157138Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.157138Z digest=sha256:c3725a25e112e71756e504cdd52d67f3cea920a108e5788dfc03d628728b97dc

Observation 1c10d555-bd33-4690-b383-d07ec364fdd1 · outbound

This paper cites Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Phenomenal Yet Puzzling: Testing Inductive Reasoning Capabilities of Language Models with Hypothesis Refinement

Reference 13

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.203000Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.203000Z digest=sha256:b924efb0eff8a8e364e3ff5301692d9d298e6fda7688c5efa0512b3bae0c582e

Observation 5ef1136c-b052-4631-b15b-59ce40ba009a · outbound

This paper cites IdeaBench: Benchmarking Large Language Models for Research Idea Generation.

AI Idea Bench 2025: AI Research Idea Generation Benchmark IdeaBench: Benchmarking Large Language Models for Research Idea Generation

Reference 14

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.208391Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.208391Z digest=sha256:d8302996056081cd6fe885660b845de17eba5bfe9e2dd0b011321ab5c1bc2d41

Observation f0577212-6a73-4d0a-9d16-f8a39968722a · outbound

This paper cites The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery

Reference 15

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.212918Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.212918Z digest=sha256:572331cd2e335ae6ec55a0bbea6c07639ca6ab1c0e0553d41f586b0b77d956f6

Observation 8a949227-e4b7-4ed9-ac30-22a72635fa55 · outbound

This paper cites Mlr-copilot: Autonomous machine learning research based on large language models agents.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Mlr-copilot: Autonomous machine learning research based on large language models agents

Reference 16

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.217865Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.217865Z digest=sha256:1768025a2167bb4f9aa8a0c8ad8a39c36906c64d5241cc658febd6839c5e7f1c

Observation 99aed0dd-00e2-44c8-be33-d77df387b0bf · outbound

This paper cites Nova: An Iterative Planning and Search Approach to Enhance Novelty and Diversity of LLM Generated Ideas.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Nova: An Iterative Planning and Search Approach to Enhance Novelty and Diversity of LLM Generated Ideas

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.223288Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.223288Z digest=sha256:742e7cbe6d2fbe8381de1f977c97549679c329b09a39560a73577b2881e8a756

Observation d84fd79f-8995-467c-b846-7d34f410f312 · outbound

This paper cites SciPIP: An LLM-based Scientific Paper Idea Proposer.

AI Idea Bench 2025: AI Research Idea Generation Benchmark SciPIP: An LLM-based Scientific Paper Idea Proposer

Reference 18

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.229759Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.229759Z digest=sha256:8c4cdc86923e8f90bfaa5334af51fc5f6a6b75911d26e978bc0418c1e50d5742

Observation 51f4c60a-42da-433e-8b1a-90bf73520251 · outbound

This paper cites Many Heads Are Better Than One: Improved Scientific Idea Generation by A LLM-Based Multi-Agent System.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Many Heads Are Better Than One: Improved Scientific Idea Generation by A LLM-Based Multi-Agent System

Reference 19

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.315863Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.315863Z digest=sha256:1ea128908ff494fb9dc8ee1ae9e28dbfb46c889282effabfa119203cda5204d6

Observation 6086f1bf-05d7-4b24-8136-1e93589b7198 · outbound

This paper cites Chain of Ideas: Revolutionizing Research Via Novel Idea Development with LLM Agents.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Chain of Ideas: Revolutionizing Research Via Novel Idea Development with LLM Agents

Reference 20

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.363302Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.363302Z digest=sha256:3f9e44140e0fba18f277c70640d7e133df5b552aabecd5ec166cad8865d0bbe1

Observation 4f4bcc7b-1d31-4a35-887a-b2f34f469ef2 · outbound

This paper cites Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Can LLMs Generate Novel Research Ideas? A Large-Scale Human Study with 100+ NLP Researchers

Reference 21

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.369684Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.369684Z digest=sha256:29425a4e8b6bcbabdcb53f25323e4edccceef81cf693f80ae6d7711eafe36f63

Observation 62e9133f-e188-4e26-b37e-6cfe68e63afc · outbound

This paper cites Openess: Event- based semantic scene understanding with open vocabularies.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Openess: Event- based semantic scene understanding with open vocabularies

Reference 22

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.687810Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.375055Z digest=sha256:b77d71407b3b33506cca5c160ad8ebbe00839ecc10b5ff1ef70c3f261fe24b57

Observation a1e7d3b6-66eb-45b9-b8f5-6d1784038c4e · outbound

This paper cites Learning transferable visual models from natural language supervision.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Learning transferable visual models from natural language supervision

Reference 23

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.380476Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.380476Z digest=sha256:5d6bb63fbb1ad4a2a1ca5fc2ed9b2faa570ec130fc17f54ca05afb66b9a61084

Observation 303a0ea5-f156-4304-b424-70d7584571a6 · outbound

This paper cites Ev-segnet: Semantic segmentation for event-based cameras.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Ev-segnet: Semantic segmentation for event-based cameras

Reference 24

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.644539Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.386025Z digest=sha256:ccfcca118c70ac0c40ea9c8d3cbdda302460190e5c3999a22499ee8dd715f649

Observation f6696076-6742-4b3f-a8f9-3bfd46bd941d · outbound

This paper cites Event-based vision: A survey.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Event-based vision: A survey

Reference 25

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.626938Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.492678Z digest=sha256:13d3c5c2a916d5c9041a633b7f029036c7f2fa8dc72a2abe68c587ca4000c5ac

Observation b46b5ac7-7877-40c8-9865-65b48091229b · outbound

This paper cites Ess: Learning event-based semantic segmentation from still images.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Ess: Learning event-based semantic segmentation from still images

Reference 26

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.505728Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.599354Z digest=sha256:16345a91e6d1fd1661c636b3d92f02f4847fa22f25b7975f49b2fd922e773d44

Observation 8916e62d-2a8a-45fd-bda3-9ab0d379cd0e · outbound

This paper cites Slic superpixels compared to state-of-the-art superpixel methods.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Slic superpixels compared to state-of-the-art superpixel methods

Reference 27

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.603879Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.603879Z digest=sha256:7a35170c3cb57d6b58bcc9ca087784113482c3a5f805a49a81a6df376b9e7cf3

Observation 57b1e4cb-25fa-48c4-b885-3b7febf057de · outbound

This paper cites Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Buffer of Thoughts: Thought-Augmented Reasoning with Large Language Models

Reference 28

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.609118Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.609118Z digest=sha256:9d84e63b47ec359c6dbef2870f0c871bcbb505ace5c55b0e9ab83cd7111b2829

Observation fdc35fbf-1454-40ba-9e94-31677db8ce6e · outbound

This paper cites Chain-of-thought prompting elicits reasoning in large language models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Chain-of-thought prompting elicits reasoning in large language models

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.613913Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.613913Z digest=sha256:282d2cd17e84189d7d412d852fb917b50c23fa91df6b054176b7a1cabacad069

Observation 7f86ebcb-470a-422c-bdc1-19617311a48f · outbound

This paper cites Tree of thoughts: Deliberate problem solving with large language models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Tree of thoughts: Deliberate problem solving with large language models

Reference 30

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.618198Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.618198Z digest=sha256:15bcd2038e567ee3e68ec30d29589e3e3523979c7235d272a92dda95fc93c91e

Observation 7a8d405e-fabf-4a55-8c8b-7710e6dc0306 · outbound

This paper cites ExpertPrompting: Instructing Large Language Models to be Distinguished Experts.

AI Idea Bench 2025: AI Research Idea Generation Benchmark ExpertPrompting: Instructing Large Language Models to be Distinguished Experts

Reference 31

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.622708Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.622708Z digest=sha256:e04dd334e623c4ea2d667375b45d5873385158da9daffc4dd32a5d16cce7e7a9

Observation d65cd50e-bc0b-4970-82e7-79518ca618ce · outbound

This paper cites Pal: Program-aided language models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Pal: Program-aided language models

Reference 32

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.326711Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.676417Z digest=sha256:17d2ac0bf3628a624429ff35b852b31b6ef677bc29c8f63c52cb5708b1285c3f

Observation ffb3e6e1-411d-49d2-9384-328769ad5be5 · outbound

This paper cites Self-Consistency Improves Chain of Thought Reasoning in Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Self-Consistency Improves Chain of Thought Reasoning in Language Models

Reference 33

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.746473Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.746473Z digest=sha256:b0fe30a8c725f7164e78c9f327c98a675a103897fae0b8f3d3b4e2d20b3647ad

Observation 61e191ab-ba7f-48da-9e9c-bfd5dffc7ae4 · outbound

This paper cites Large language models are few-shot clinical information extractors.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Large language models are few-shot clinical information extractors

Reference 34

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.305432Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.751380Z digest=sha256:bdfc84e88021771bb1ffc3f0c14eac1dd4606ffc5ccc3009f3453a0f21b2a4ba

Observation 4b2e03f1-4830-4917-9a61-1b2e0ff17c81 · outbound

This paper cites Nlice: Synthetic medical record generation for effective primary healthcare differential diagnosis.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Nlice: Synthetic medical record generation for effective primary healthcare differential diagnosis

Reference 35

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.263947Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.756308Z digest=sha256:20b0d4aef27db1da5fb7700ec71ef4bb3bcc4c95c4a3e7457e96d9ac0616d1f9

Observation 58fdba56-8f57-4607-bb6d-751d33fa42cd · outbound

This paper cites Ehrxqa: A multi-modal question answering dataset for electronic health records with chest x-ray images.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Ehrxqa: A multi-modal question answering dataset for electronic health records with chest x-ray images

Reference 36

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.191937Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.760736Z digest=sha256:f1fc4347d0657f59f44c83914bbdb791257b1a8d6561619f76ae6111bd896c2b

Observation bb158785-13c0-4b9e-b35d-1b7cdc42d9da · outbound

This paper cites Comparative accuracy of diagnosis by collective intelligence of multiple physicians vs individual physicians.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Comparative accuracy of diagnosis by collective intelligence of multiple physicians vs individual physicians

Reference 37

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.143659Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.765493Z digest=sha256:0c2e0d176359bf819a9a9066390f77e8b568ad0ceeddb2c685e18dc190151d89

Observation baf43570-f2e5-4604-9eed-28faff588fa0 · outbound

This paper cites The use of analytic hierarchy process for measuring the complexity of medical diagnosis.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The use of analytic hierarchy process for measuring the complexity of medical diagnosis

Reference 38

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:25.073329Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.770723Z digest=sha256:fcfe940477c3130447d74a501b2d240345caad76393ae485330fa3dc3c57735f

Observation b45a8295-e1a0-4ec1-8c50-d5651012a67c · outbound

This paper cites Koala: Key frame-conditioned long video-llm.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Koala: Key frame-conditioned long video-llm

Reference 39

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.947731Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.775364Z digest=sha256:1a8d4be405156ec8164c70e0478b8c2cc3cc7a1b799a333e4111bd854e556cdc

Observation 21b4328b-8c1b-40c2-aa7c-5b9bd622ff47 · outbound

This paper cites VideoChat: Chat-Centric Video Understanding.

AI Idea Bench 2025: AI Research Idea Generation Benchmark VideoChat: Chat-Centric Video Understanding

Reference 40

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.780047Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.780047Z digest=sha256:7c9911a07d7986524d34b3ecf03186cb29664494716b29814d522bff81b35d70

Observation 9d1a3d3c-65ff-4dec-afce-9efe504630a2 · outbound

This paper cites Egoschema: A diagnostic benchmark for very long-form video language understanding.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Egoschema: A diagnostic benchmark for very long-form video language understanding

Reference 41

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.933636Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.905401Z digest=sha256:b2dde8eb4e1834073044e5cd658254c05f8b9f103ac02f519da289f61a2878fa

Observation 726d7a34-d195-4694-abe2-1bf9e8c08e4e · outbound

This paper cites Howto100m: Learning a text-video embedding by watching hundred million narrated video clips.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Howto100m: Learning a text-video embedding by watching hundred million narrated video clips

Reference 42

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.946871Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.946871Z digest=sha256:625c6d9b34b0e50405c4c07c8adb664772f3165aad265e17dea5a7bf72ccffb3

Observation 5137740b-5826-48e6-94e9-1b6820ff0d72 · outbound

This paper cites Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Video-LLaMA: An Instruction-tuned Audio-Visual Language Model for Video Understanding

Reference 43

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.952993Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.952993Z digest=sha256:bd224bc480eaa766f655feb925b22d29267e1fc4679d6ffec1b8746e7badf1c4

Observation 4751138d-ce50-438e-bf3d-e931aebdb1ba · outbound

This paper cites Fine-grained cross-view geo- localization using a correlation-aware homography estimator.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Fine-grained cross-view geo- localization using a correlation-aware homography estimator

Reference 44

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.909355Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.957771Z digest=sha256:384c12b9aa0b9d26976ac6a69d61ab9966727a76b3ccb5be924bf203d9270fed

Observation 79a11e85-f7ee-41ae-860a-0da46d93c6c7 · outbound

This paper cites R-tuning: Instructing large language models to say ‘i don’t know’.

AI Idea Bench 2025: AI Research Idea Generation Benchmark R-tuning: Instructing large language models to say ‘i don’t know’

Reference 45

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.895141Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.962704Z digest=sha256:018f8d5566c5a9126160d708be8905a386ff7e79ef885b422b349e117e80e707

Observation a9ece942-fad2-401d-96fb-e18ccaee898b · outbound

This paper cites Selfcheckgpt: Zero-resource black-box hallucination detection for generative large language models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Selfcheckgpt: Zero-resource black-box hallucination detection for generative large language models

Reference 46

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.880899Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.967058Z digest=sha256:a2231c34cc37302de56ddb85dc694403a3a51aabc960f3c498e8c8b9d40d1836

Observation be949c40-7407-4b62-8478-b54e02c474f8 · outbound

This paper cites On Faithfulness and Factuality in Abstractive Summarization.

AI Idea Bench 2025: AI Research Idea Generation Benchmark On Faithfulness and Factuality in Abstractive Summarization

Reference 47

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.971103Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.971103Z digest=sha256:6b14b589cb16a1da696afacf0c0c1ba898ad4cdf50fb938df1d5da306e00f47f

Observation 7f49206f-21eb-4d9c-bce6-3d6833982653 · outbound

This paper cites Measuring Massive Multitask Language Understanding.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Measuring Massive Multitask Language Understanding

Reference 48

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:21.975720Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:21.975720Z digest=sha256:3d03c014aa4dc192113fa7d6e4894b48b70d7a74635e974910ed46cd2c1f6f8b

Observation 00919fb0-35c5-49bc-aa7d-7cb4b5fe377f · outbound

This paper cites On calibration of modern neural networks.

AI Idea Bench 2025: AI Research Idea Generation Benchmark On calibration of modern neural networks

Reference 49

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.865031Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.037426Z digest=sha256:97cb469fe332bbade37a9e991a5f90309d87cec57ef43f80fbd75b64a1f6d672

Observation 2718f6db-b243-46e6-a41b-fcb11c49c3f4 · outbound

This paper cites LLaMA: Open and Efficient Foundation Language Models.

AI Idea Bench 2025: AI Research Idea Generation Benchmark LLaMA: Open and Efficient Foundation Language Models

Reference 50

Resolution
unresolved
no resolver link, observed 2026-08-16T11:58:22.084913Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-16T11:58:22.084913Z digest=sha256:f09e8c623c81d6339d5b09ef4906f569de106184f6144480e2a39c27bd2b22e9

Observation c3402551-240f-4f79-9933-421fcf7501a1 · outbound

This paper cites Diagnostic Accuracy.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Diagnostic Accuracy

Reference 52

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.781221Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.090442Z digest=sha256:e621490f7038d1449d5272b0eb6c7c7e688a66578a1a08ab91c3b3b388f6926a

Observation 09fd381e-7358-4c67-b390-de96d74b5a2e · outbound

This paper cites Temporal Consistency Score.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Temporal Consistency Score

Reference 53

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.625652Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.095190Z digest=sha256:3447afd0c68affdd51ccf3fe0779e2665a2afe358f4fa83ce87cabcf2f979dae

Observation 76e053e4-e9d9-41e0-bc24-1db72b9fe0f1 · outbound

This paper cites Explainability Assessment.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Explainability Assessment

Reference 54

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.597310Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.099989Z digest=sha256:7357f19b75245102f7b2420f5de9dd8d75e5b52bfdd112b1ccb53b8dceb834f7

Observation e98d30c7-d718-4728-b474-f5f694ede798 · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 55

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.571375Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.106223Z digest=sha256:66d7fff13dfcb6aa815ede4c19c37f1a921aef011d628c3b8ad9dd32e35cd6e0

Observation ef8977be-2378-4982-b600-9eeab933f65d · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 56

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.553868Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.110710Z digest=sha256:ad7ac2e1789436abc2928dab3010b62303c064d6f8b8f8b9f85969283cfc1732

Observation 5df5f245-a900-4ca4-98bb-24127b6a2c40 · outbound

This paper cites technology).

AI Idea Bench 2025: AI Research Idea Generation Benchmark technology)

Reference 57

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.523968Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.150028Z digest=sha256:6323d4b96ec3afe80cda82e1313d4c2c1a56cb8fc94eda41d0b6f9ec9e911e54

Observation 6ddd717a-4995-4ea2-b591-4a3f9b8a4b4d · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 58

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.499168Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.218868Z digest=sha256:d5b0b78ba19179dd17662adff58aea21d0be61ed724e49f1b3a4faa492d4b6a1

Observation 6b79f5f4-d18e-449d-a69a-d3d2a6658d31 · outbound

This paper cites motivation_similarity.

AI Idea Bench 2025: AI Research Idea Generation Benchmark motivation_similarity

Reference 59

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.473692Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.301848Z digest=sha256:9964b5d67c6e83f00939287375d94e2110be1924383904b99850d1d80c6fa6dd

Observation 9569f231-2ada-49c7-a788-21028d82d285 · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 60

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.351567Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.308104Z digest=sha256:2cee057d0590b4fad4c2f2970d983493af0359ad0114c76781900111318b3b49

Observation 78c1a0f9-18ce-4174-8a28-a72441d78db7 · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 61

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.325439Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.312767Z digest=sha256:7e8af0973cb8e0edee2063ae5652f65319a5284511e2143fcf0278396b72ec55

Observation 26c0743f-210a-4ae4-befa-e2920d3f2170 · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 62

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.190753Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.317520Z digest=sha256:3b9126cda29bf647451f7e3dcd339d9f6173f89eb2d1de8637128b2402c0c8c6

Observation 99c337f1-12eb-4e83-8dce-b470edcb66ee · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 63

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:24.172813Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.322448Z digest=sha256:c3d58c37f11eedce570348feeff536690e6804908534e2d9b002d0febf6bd2b7

Observation f06f6786-5f50-4140-85a1-e098c8114fdf · outbound

This paper cites experiment_plan_similarity.

AI Idea Bench 2025: AI Research Idea Generation Benchmark experiment_plan_similarity

Reference 64

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.070802Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.328405Z digest=sha256:c9fb33a9ad5f723e25276355fe6cd8acb5d6772465d10849416d74f17ee1bd96

Observation 9436f788-c9e6-417e-9e54-a0063c5c6a3e · outbound

This paper cites The motivation does not address the topic, and the Experimental plan does not effectively test the research question posed.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The motivation does not address the topic, and the Experimental plan does not effectively test the research question posed

Reference 65

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:24.056131Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.367463Z digest=sha256:9722c2e37a4a9028fa0e4ab13138e862ca01589e437294a8a4732f4b4f50284d

Observation bef90335-f4da-4e6e-9399-015b1f1d3b84 · outbound

This paper cites The motivation addresses the topic but in a vague or unclear manner, and the Experimental plan partially, but not effectively, tests the research question.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The motivation addresses the topic but in a vague or unclear manner, and the Experimental plan partially, but not effectively, tests the research question

Reference 66

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:23.951234Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.451053Z digest=sha256:ea63a0b68c60a6d425aa104236891f978c2a31870cbd9e3fe1de53ae148a4f05

Observation d4388bc4-8799-4600-ab88-b58dfbe44302 · outbound

This paper cites The motivation explains the topic, but with some gaps in clarity, and the Experimental plan mostly addresses the research question, though some methods may not be optimal.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The motivation explains the topic, but with some gaps in clarity, and the Experimental plan mostly addresses the research question, though some methods may not be optimal

Reference 67

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:23.870583Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.493236Z digest=sha256:83eab5176d2d94424d51e8dc6205bb62c669cb184fb3920dc07fed1c97c57acc

Observation d23691ea-e0e4-4a82-800f-daa7363563b1 · outbound

This paper cites The motivation explains the research problem well, and the Experimental plan is suitable and addresses the research question effectively.

AI Idea Bench 2025: AI Research Idea Generation Benchmark The motivation explains the research problem well, and the Experimental plan is suitable and addresses the research question effectively

Reference 68

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:23.782717Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.499245Z digest=sha256:5819bc002a1975ec94953480068dbf52410a11677f670f20a7e8404993a6760b

Observation c1220d2f-484e-4e67-9c6f-c3b41805c268 · outbound

This paper cites motivation.

AI Idea Bench 2025: AI Research Idea Generation Benchmark motivation

Reference 69

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:23.690220Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.503943Z digest=sha256:8747072feb598fe1bbffa1c815f5c121abb00a2f79f1c4e7e9ea428842538f95

Observation 08a71801-7915-4512-8fde-405b48b7a238 · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 70

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:23.673227Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.508648Z digest=sha256:739bd533e69f1ee0e0dd2df46a8e0ba18fb5b9aa238cad5c1f9f0865abfe8b35

Observation b463453e-6ace-41fa-87b3-73713eadb55d · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 71

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:23.577337Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.514352Z digest=sha256:7eaeff66f4ab39a302065640f769f583ca57b9a8a6edf84360863c98eaa2a1b4

Observation 7e6fb919-cda7-4159-a4ef-58d557f56d2c · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 72

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:23.415373Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.599114Z digest=sha256:4ece7f1a6cb8f43490ab2aa891f149dba84febccf2d1f3c17da0b78a60d0dc23

Observation 503fa07c-36c8-42dc-816e-33a7cf32b01a · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 73

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:23.372147Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.630312Z digest=sha256:ac29d50fcea739891dccaa90cd5ec176f7188338d1e0902791930eb132c50735

Observation a054e342-45dc-44cf-a196-f86824d900ca · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 74

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:23.279910Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.636590Z digest=sha256:6d2968bb43c7369bb7b8b6c5636267049d13b9454a93c5c7ae512403f2d12009

Observation faa00754-e390-4524-87df-4399f07e0a39 · outbound

This paper cites Novelty_choice.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Novelty_choice

Reference 75

Resolution
verified fuzzy
raw_fallback, observed 2026-08-16T11:58:23.216824Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:22.641579Z digest=sha256:52fa9f8c3691ae518daaa8edd1a9e9802199a51e229e59c270d69cbb5f67e7d3

Observation ca06826d-62c4-424c-8eef-92a24b76925b · outbound

This paper cites an unresolved cited work.

AI Idea Bench 2025: AI Research Idea Generation Benchmark Unresolved cited work

Reference 2023

Resolution
unresolved
raw_fallback, observed 2026-08-16T11:58:25.711859Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-08-16T11:58:21.029193Z digest=sha256:c71f8762d4817a44a4f025249b68b6688b98d601d500cf3189ddaa3fe1e80945

Pith citing papers

Observation 5d9e6f68-d8a6-4da0-8dbe-6e1b3a893f03 · inbound

InternAgent: When Agent Becomes the Scientist -- Building Closed-Loop System from Hypothesis to Verification cites this paper.

InternAgent: When Agent Becomes the Scientist -- Building Closed-Loop System from Hypothesis to Verification AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 29

Resolution
unresolved
no resolver link, observed 2026-08-07T14:56:35.190567Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-07T14:56:35.190567Z digest=sha256:fd0010507bc695477d16ff7b07b2014513a2f931b37db04ce2039b22887d8bb4

Observation 4bc94ee8-8935-44bc-8ef0-b686a58b9cf7 · inbound

Creativity in LLM-based Multi-Agent Systems: A Survey cites this paper.

Creativity in LLM-based Multi-Agent Systems: A Survey AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 6

Resolution
unresolved
no resolver link, observed 2026-08-07T13:43:22.887540Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T13:43:22.887540Z digest=sha256:e5336a38c6b78e618d09ce688243b3af466857cd1a0551678e309f3e2acecef3

Observation b63b174f-8a0e-4df4-9e7e-d8c29bbf389b · inbound

SafeScientist: Toward Risk-Aware Scientific Discoveries by LLM Agents cites this paper.

SafeScientist: Toward Risk-Aware Scientific Discoveries by LLM Agents AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 7

Resolution
unresolved
no resolver link, observed 2026-08-07T12:46:29.896693Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-07T12:46:29.896693Z digest=sha256:f72b6b9ca1d3e59f7550dd39edfeebbf0dbb931acfb0805ad19cc7555d891f02

Observation 0ce9a3a5-961c-4ee4-b7ea-01e36e925df1 · inbound

AD-Bench: A Real-World, Trajectory-Aware Advertising Analytics Benchmark for LLM Agents cites this paper.

AD-Bench: A Real-World, Trajectory-Aware Advertising Analytics Benchmark for LLM Agents AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 2025

Resolution
unresolved
no resolver link, observed 2026-08-02T23:19:15.220053Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T23:19:15.220053Z digest=sha256:7e8c049bde7de2046305b510ad6aeb260c438e17b752397c02182cdce3542037

Observation 8add1d33-042d-49c4-8709-cb9ed2737f75 · inbound

SciDER: Scientific Data-centric End-to-end Researcher cites this paper.

SciDER: Scientific Data-centric End-to-end Researcher AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 17

Resolution
unresolved
no resolver link, observed 2026-08-02T19:41:50.287221Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T19:41:50.287221Z digest=sha256:70653cc776c29c935c3b86b68a0b4168e59e6fb79e235afaa5bac15532a5305b

Observation f1e60427-4787-4325-8b27-cb5a7741c716 · inbound

Intern-Atlas: A Methodological Evolution Graph as Research Infrastructure for AI Scientists cites this paper.

Intern-Atlas: A Methodological Evolution Graph as Research Infrastructure for AI Scientists AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 27

Resolution
metadata mismatch
arxiv_id, observed 2026-05-12T10:16:28.564631Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-07T06:42:17.145367Z digest=sha256:e1bd619ae0d81cf866c0708ce07d04acfb2d8f9b3a0597e178685b648dca4585

Observation abd265d6-0fff-44f7-a8db-07eff9a7cf2f · inbound

Evolving Idea Graphs with Learnable Edits-and-Commits for Multi-Agent Scientific Ideation cites this paper.

Evolving Idea Graphs with Learnable Edits-and-Commits for Multi-Agent Scientific Ideation AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 9

Resolution
metadata mismatch
arxiv_id, observed 2026-05-11T18:36:06.848758Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-08T15:34:46.766866Z digest=sha256:2eef917a96c9002a54a7d6e354a22a1e4ff79df2610697159c32f46e8792a182

Observation 71594fa6-0b39-467d-a124-ec2601e58981 · inbound

MLReplicate: Benchmarking Autonomous Research Systems for Machine Learning Reproducibility cites this paper.

MLReplicate: Benchmarking Autonomous Research Systems for Machine Learning Reproducibility AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 26

Resolution
verified exact
arxiv_id, observed 2026-05-20T20:03:43.974081Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-20T19:59:40.519962Z digest=sha256:01072c240b241289fd955f0ac4e8e6fb0f06893bc1ae2fd6730f457d709e0908

Observation 2b08c58d-21ba-43ef-bb78-325484a96e30 · inbound

AI for Auto-Research: Roadmap & User Guide cites this paper.

AI for Auto-Research: Roadmap & User Guide AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 154

Resolution
verified exact
arxiv_id, observed 2026-05-20T10:33:12.456178Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=pdf_text observed=2026-05-20T10:30:50.256635Z digest=sha256:d294b4068eb37799b934292e5661edc7100129174328141311a91655daf12d6c

Observation fa165538-f407-4df4-979c-dd555cd76d2c · inbound

AI for Auto-Research: Roadmap & User Guide cites this paper.

AI for Auto-Research: Roadmap & User Guide AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 154

Resolution
unresolved
no resolver link, observed 2026-08-02T13:43:42.447834Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-02T13:43:42.447834Z digest=sha256:6e269ec1c7d15310cec3b19ad0977b14adb9bebe23350e66d2c9fb423464d371

Observation 65f774b2-fc6b-47d6-babe-b801240feb91 · inbound

IDEAFix: Evaluation Framework for Creative Defixation Prompting in LLMs cites this paper.

IDEAFix: Evaluation Framework for Creative Defixation Prompting in LLMs AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 5

Resolution
metadata mismatch
arxiv_id, observed 2026-06-28T18:42:28.931783Z

Source-reported events for the cited work

No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.

source=arxiv_source observed=2026-06-28T18:42:00.845492Z digest=sha256:f0bcfe23b87590ccf579d6cfb37f593ab41b23cbaeb5e4ee666c3da105e079f8

Observation 7089f488-7244-44b6-b19f-033139c1cbef · inbound

ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes cites this paper.

ResearchStudio-Idea: An Evidence-Grounded Research-Ideation Skill Suite from ML Conference Outcomes AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 36

Resolution
unresolved
no resolver link, observed 2026-07-11T19:11:37.739920Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-07-11T19:11:37.739920Z digest=sha256:ee2d50805ab59c0595511f86b37e6b04a7d6a0de5a8ab4ea80d92d15ae57d2bc

Observation 552513ba-3072-4de0-9893-a9fa6b36bb6f · inbound

Tree-of-Ideas: Automated Research Ideation via Cross-Trajectory Reasoning over Scholarly Evolution cites this paper.

Tree-of-Ideas: Automated Research Ideation via Cross-Trajectory Reasoning over Scholarly Evolution AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 2

Resolution
unresolved
no resolver link, observed 2026-08-12T18:21:41.261437Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=pdf_text observed=2026-08-12T18:21:41.261437Z digest=sha256:06716be4e9a6b6145c827c85a876770c41c94e211fb48f763d7f5882d8258e41

Observation 21dc9f61-24d9-4954-a9f2-80e9d54ba09b · inbound

LigBench: A Unified and Human-Aligned Benchmark for LLM-based Research Idea Generation cites this paper.

LigBench: A Unified and Human-Aligned Benchmark for LLM-based Research Idea Generation AI Idea Bench 2025: AI Research Idea Generation Benchmark

Reference 44

Resolution
unresolved
no resolver link, observed 2026-08-15T16:07:42.694240Z

Source-reported events for the cited work

Unavailable: canonical work link unavailable.

source=arxiv_source observed=2026-08-15T16:07:42.694240Z digest=sha256:c46c4d41de654fc8d6a89a1fc4965711eec4d29ec2a951e35c054e6f066f0d49