{"as_of":"2026-08-09T01:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:30559dd94d73cb046059e3f988b1e5aed6808ec3e4faf8e66c87f8fb1553cb03","coverage":[{"denominator":80,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":80,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T14:38:40.017263Z","state":"measured"},{"denominator":81,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":81,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T06:30:16.612345Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.01961","snapshot_observed_at":"2026-07-14T06:30:16.612345Z","title":"Automedbench: Towards medical autoresearch with agentic ai models.arXiv preprint arXiv:2606.01961, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11175","last_updated":"2026-07-13T07:16:50Z","snapshot_observed_at":"2026-07-16T23:19:14.481825Z","submitted_at":"2026-07-13T07:16:50Z","title":"The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Autonomy","version":1},"reference_index":149,"source":"pdf_text","source_observed_at":"2026-07-14T06:30:16.612345Z"},"links":{"cited_paper":"/paper/2606.01961","citing_paper":"/paper/2607.11175"},"observation_digest":"sha256:c7ab4b3e6b36152cc0dd9de3c9c76cc0310ac8b165a7c215db1df7d45330f208","observation_id":"c9a37d92-a99c-4543-987f-6a83fcddc3fe","resolution":{"observed_at":"2026-07-14T06:30:16.612345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.01961/citation-record","integrity":"/paper/2606.01961/integrity","json":"/paper/2606.01961/citation-record.json","paper":"/paper/2606.01961"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"AAPM low-dose CT grand challenge (LDCT-SimNICT).https://www.aapm","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:f233d1788d27838dfdd50a77b8d73ba4d830081da4f572e72fbadbd35e38eefd","observation_id":"916ad50a-591d-46ad-a0b8-aa8f0c293545","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Claude Opus 4.6 system card.https://www-cdn.anthropic.com/ 14e4fb01875d2a69f646fa5e574dea2b1c0ff7b5.pdf, February 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:0b236d188db79feb9915ec6383bd0340fe1eb2cd57115f92a5ee697d20cbd88b","observation_id":"20847565-e594-49a4-aabe-a05fffa844f7","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Lawrence Zitnick, and Devi Parikh","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:287e6a076856c315d2dc5a53f4efd363b65655600595775f327f0df48c5b581c","observation_id":"3b9bf7c7-03a7-4b4a-9239-31771f03a560","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.08775","last_updated":"2025-05-13T17:53:59Z","snapshot_observed_at":"2026-07-06T21:23:23.760393Z","submitted_at":"2025-05-13T17:53:59Z","title":"HealthBench: Evaluating Large Language Models Towards Improved Human Health","version":1},"cited_work":{"arxiv_id":"2505.08775","doi":"10.48550/arxiv.2505.08775","metadata_source":"pith","pith_arxiv_id":"2505.08775","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HealthBench: Evaluating Large Language Models Towards Improved Human Health","venue":"cs.CL","work_id":"5d613c2c-158f-488c-9981-fc9b82a5e093","year":2025},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2505.08775","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:ac8cc4fb9a4f825d2ca426345ede723099d86ddaa89f3c9e286d4d69329c4040","observation_id":"d30e4737-c523-4b59-9660-980866c81c84","resolution":{"observed_at":"2026-07-01T23:06:21.112444Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"METEOR: An automatic metric for MT evaluation with improved correlation with human judgments","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:3d48e3360eb3c987f1148c9a7e424369793946d354b1f3e65355b15eba11d95e","observation_id":"eb6849ab-a01a-4a43-9944-c909bae1c906","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23802","last_updated":"2025-06-02T04:19:10Z","snapshot_observed_at":"2026-08-07T13:49:27.300077Z","submitted_at":"2025-05-26T22:55:49Z","title":"MedHELM: Holistic Evaluation of Large Language Models for Medical Tasks","version":2},"cited_work":{"arxiv_id":"2505.23802","doi":"10.48550/arxiv.2505.23802","metadata_source":"pith","pith_arxiv_id":"2505.23802","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Medhelm: Holistic evaluation of large language models for medical tasks.arXiv preprint arXiv:2505.23802","venue":"cs.CL","work_id":"10fde960-6858-49b3-a93a-c1429deb1170","year":2025},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2505.23802","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:e05167fb598b77cda65f6f8c8672a0238b41ff08323b5734353ecb2d85216806","observation_id":"09695644-9950-4a37-a589-a75502a21ca0","resolution":{"observed_at":"2026-07-01T23:06:21.116582Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41591-025-04151-2","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"autonomy","venue":"Nature Medicine","work_id":"88e3fba0-155a-4a37-a547-fb1c712e9428","year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:7f2239527e881fe4985226e7a10fd4dd11611d7b1e84044c27e77470ad578809","observation_id":"a2414a59-e6ae-4ca8-8ef6-58b7e0e1479c","resolution":{"observed_at":"2026-06-28T14:42:17.751463Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-15T22:51:36.302773+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T22:51:36.302773+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.09937","last_updated":"2026-04-10T22:33:39Z","snapshot_observed_at":"2026-07-06T22:58:43.155246Z","submitted_at":"2026-04-10T22:33:39Z","title":"HealthAdminBench: Evaluating Computer-Use Agents on Healthcare Administration Tasks","version":1},"cited_work":{"arxiv_id":"2604.09937","doi":"10.48550/arxiv.2604.09937","metadata_source":"pith","pith_arxiv_id":"2604.09937","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"HealthAdminBench: Evaluating Computer-Use Agents on Healthcare Administration Tasks","venue":"cs.AI","work_id":"439b2e39-cfb3-49e7-8351-79b45f1a2589","year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2604.09937","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:f7b77602729be8b237aa638a26f0e7ac040231bf8be3ff11d1b33214a3fbbce9","observation_id":"cae89cbf-3895-4f36-925e-5a9d1b2734de","resolution":{"observed_at":"2026-07-01T23:06:21.087558Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"PANTHER challenge: Public training dataset, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:b0ab2f878085422e7c6fdb1ed9f8f8bc723ffd0426fdc9c966a9019de9214ccd","observation_id":"5c715ff7-8de7-4752-a93c-3885b397c829","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"PanTS: Pancreatic tumor segmentation.https://huggingface.co/ datasets/BodyMaps/PanTSMini, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:7e9e2e5c5df023c3c7d15dc20be396efeb8c75942bf160e304eab778c43525ca","observation_id":"33ebc104-0da3-4908-9ce3-9a374e924c4a","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"End-to-end object detection with transformers","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:1d9674bf96acce0f33bb3a05f7d28b8f8c5430bf5fe65197370299cd44468302","observation_id":"263ca44b-e83b-4018-970d-2b36f5261bef","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.19538","last_updated":"2024-06-03T19:14:12Z","snapshot_observed_at":"2026-08-04T20:54:55.500114Z","submitted_at":"2024-05-29T21:48:56Z","title":"CheXpert Plus: Augmenting a Large Chest X-ray Dataset with Text Radiology Reports, Patient Demographics and Additional Image Formats","version":2},"cited_work":{"arxiv_id":"2405.19538","doi":"10.48550/arxiv.2405.19538","metadata_source":"pith","pith_arxiv_id":"2405.19538","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Chexpert plus: Hundreds of thousands of aligned radiology texts, im- ages and patients","venue":"cs.CL","work_id":"5711e49b-bd52-4d98-a80e-65367e05b206","year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2405.19538","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:276fc4101869a76266312d8481016f18e8271f475811f6491c0832c2df7c7985","observation_id":"6fe69d4c-de91-49ea-96f7-fd0fa47fc359","resolution":{"observed_at":"2026-07-01T23:06:21.101309Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"MLE-bench: Evaluating machine learning agents on machine learning engineering,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:0a2841415102253343e689e948e739d9013a77b539a9e30ef15193d980984da4","observation_id":"d6843f89-c972-4670-aba2-0cf7307ec310","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.07095","last_updated":"2025-02-26T11:57:30Z","snapshot_observed_at":"2026-08-06T21:08:58.653035Z","submitted_at":"2024-10-09T17:34:27Z","title":"MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering","version":6},"cited_work":{"arxiv_id":"2410.07095","doi":"10.48550/arxiv.2410.07095","metadata_source":"pith","pith_arxiv_id":"2410.07095","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"MLE-bench: Evaluating Machine Learning Agents on Machine Learning Engineering","venue":"cs.CL","work_id":"a671e43f-ceab-49e7-adc3-473d802a97ca","year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2410.07095","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:a79d14571cb80a22987aa5270bf429633c15e98629c3e23bc07c94d146431170","observation_id":"ac48592d-2c15-40fc-9674-b48ffeda9bf4","resolution":{"observed_at":"2026-07-01T23:06:21.108710Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/tmi.2017","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T15:52:21.613107Z","title":"IEEE Transactions on Medi- cal Imaging36(8), 1597–1606 (Aug 2017).https://doi.org/10.1109/TMI.2017","venue":null,"work_id":"5e9cffcf-21e0-4cd8-b6c7-b733c8a71780","year":2017},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:868343f7e0bfb0362cf6d1801c18428c75a51d07e34d73532cddda644e69aa53","observation_id":"27f64636-a80c-4a41-be60-a781e87ae554","resolution":{"observed_at":"2026-06-28T14:42:17.787534Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Generating radiology reports via memory-driven transformer","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:bf4cb3ac871751a71f02f44685e909d1184d30ac424632c8b3cbf8f7f0e1a8e2","observation_id":"e1cef2d1-9781-48ea-a470-589e4d49cdd0","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/jamia/ocv080","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Demner-Fushman, M","venue":"Journal of the American Medical Informatics Association","work_id":"06440441-c870-4061-8dfe-0324eac295b9","year":2016},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:a8521bb1124fd7e9fe6f38dc00e6c8178db753597b77a25d22478f971eef024e","observation_id":"0992bc6f-2349-485d-a05b-6de26f522c41","resolution":{"observed_at":"2026-06-28T14:42:17.771872Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.2307/1932409","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Measures of the Amount of Ecologic Association Between Species","venue":"Ecology","work_id":"b7f694cd-2f1f-4021-8200-ec745c1c593d","year":1945},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:b1007059c36d3aee725e7b1394a58514f283431c4df65903024ca75de35fc26d","observation_id":"eae58070-a2cd-4bb4-bdf0-6979eb0d2301","resolution":{"observed_at":"2026-06-28T14:42:17.781892Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-15T15:20:16.991619+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-15T15:20:16.991619+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1007/s11263-009-0275-4","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Available: https://doi.org/10.1007/s11263-009-0275-4","venue":"International Journal of Computer Vision","work_id":"aa0c9582-b8ae-4593-8c07-12bff6f72d41","year":2010},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:aae467049b0c7dbae962d6198b9d4ad37b2721390d677366f6d6697c54568163","observation_id":"af1e7e51-984e-4589-bead-e10f5d7fba14","resolution":{"observed_at":"2026-06-28T14:42:17.785816Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-06T20:38:15.586394+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-06T20:38:15.586394+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"FeTA challenge: Fetal brain tissue annotation and segmentation.https: //fetachallenge.github.io/, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:f12bfacc3a0703078ef14ffbce883e0dc32e9b85c9b279475ac11f502919aecf","observation_id":"4817b442-f21e-4837-aef3-ff6c2fb4512a","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.10696","last_updated":"2026-04-12T15:43:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-12T15:43:50Z","title":"Camyla: Scaling Autonomous Research in Medical Image Segmentation","version":1},"cited_work":{"arxiv_id":"2604.10696","doi":"10.48550/arxiv.2604.10696","metadata_source":"pith","pith_arxiv_id":"2604.10696","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Camyla: Scaling Autonomous Research in Medical Image Segmentation","venue":"cs.AI","work_id":"ed9d0c2a-d3be-4192-9512-e94a83b408d4","year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2604.10696","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:f8cd53260657a30d3036dbc54bf2c5172d57143a17050f8ae03340a78edb778b","observation_id":"14d13a2c-375e-404e-a19f-0c3ccd88cd3e","resolution":{"observed_at":"2026-07-01T23:06:21.140386Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15763","last_updated":"2026-02-24T10:44:44Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-02-17T17:50:56Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","version":2},"cited_work":{"arxiv_id":"2602.15763","doi":"10.48550/arxiv.2602.15763","metadata_source":"pith","pith_arxiv_id":"2602.15763","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-5: from Vibe Coding to Agentic Engineering","venue":"cs.LG","work_id":"ad29b1a2-bf77-46b3-9ead-fb62b1d2c6fe","year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2602.15763","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:9a0e3bcaede28b60deb244e59740166d76802ae59807ad47ebd789e3e0b1235e","observation_id":"09688aa8-68e0-45d8-ae06-6fc596454ba8","resolution":{"observed_at":"2026-07-01T23:06:21.148476Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Gemini 3.1 Pro model card.https://deepmind.google/ models/model-cards/gemini-3-1-pro/, February 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:59bc252430a9c624c8788c5454e809ae58ba6629e037be87171b5761e9792692","observation_id":"a7825ae4-d91b-4005-a7ce-8bd4147c4765","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"DENTEX: Dental enumeration and diagnosis on panoramic x-rays.https://huggingface.co/datasets/ibrahimhamamci/DENTEX, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:9fde75f91f85a72df2677c8cc98e42f03bc446e6896045613531cfc25013efda","observation_id":"5bc04c3f-71e9-42bc-af5a-c36a51a954b2","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2003.10286","last_updated":"2020-03-07T17:55:41Z","snapshot_observed_at":"2026-07-06T09:06:42.071993Z","submitted_at":"2020-03-07T17:55:41Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","version":1},"cited_work":{"arxiv_id":"2003.10286","doi":null,"metadata_source":"pith","pith_arxiv_id":"2003.10286","snapshot_observed_at":"2026-07-10T18:57:31.568292Z","title":"PathVQA: 30000+ Questions for Medical Visual Question Answering","venue":"cs.CL","work_id":"4e35c15f-5a72-4a89-a773-9d4036871506","year":2020},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2003.10286","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:5a1be62b070178803a392713dc7fbd4cd2f7e356aeb208659682a6d077e21ee6","observation_id":"fa211428-2eeb-4057-8a99-65e59c854822","resolution":{"observed_at":"2026-07-01T23:06:21.157019Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"KiTS19: Kidney tumor segmentation challenge.https://kits19","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:bfb5d5774dd775f895a0c3caa1896e8a4d599fe8aca26fc429db951e10ab4645","observation_id":"686951db-7913-4476-9e5b-5d9c5e4320ba","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.27470","last_updated":"2026-04-30T06:13:01Z","snapshot_observed_at":"2026-07-06T23:12:57.730833Z","submitted_at":"2026-04-30T06:13:01Z","title":"HealthBench Professional: Evaluating Large Language Models on Real Clinician Chats","version":1},"cited_work":{"arxiv_id":"2604.27470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.27470","snapshot_observed_at":"2026-07-01T23:06:21.126714Z","title":"HealthBench Professional: Evaluating Large Language Models on Real Clinician Chats","venue":"cs.CL","work_id":"00e32614-328b-421a-b45c-6145e5f57285","year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2604.27470","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:5f31edcba64b74566e6f194ddd11ef041d8a694ff90b1ec45aafec79ea6fd2e2","observation_id":"8d0573de-4d3e-48f0-8133-5888ffc15a49","resolution":{"observed_at":"2026-07-01T23:06:21.128547Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"MLAgentBench: Evaluating lan- guage agents on machine learning experimentation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:d02026190f99e2a08866400eee377cfed279b4386a66e4f4c962d19949917243","observation_id":"8e28c5cc-fafb-4984-abe5-13cad87dd011","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41592-020-01008-z","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"nnU-Net: A Self-Configuring Method for Deep Learning-Based Biomedical Image Segmentation","venue":"Nature Methods","work_id":"f4eb2d12-cd0d-4215-87b4-59ca83a256f7","year":2021},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:2f1b894b7f9008b263cc428b69f98816557707740e6d57f68dc35143bc6aa318","observation_id":"0f7f84d9-bf11-4090-9d38-d38adb202923","resolution":{"observed_at":"2026-06-28T14:42:17.775042Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-01T11:38:14.477212+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T11:38:14.477212+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.13026/hm87-5p47","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Q., Nguyen Duong , D., Bui, T., Chambon, P., Lungren, M., Ng, A., Langlotz, C., and Rajpurkar, P","venue":"arXiv (Cornell University)","work_id":"76aecb4c-0b51-430e-a829-d5375fb2aa30","year":2021},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:d0f908c7b37b51362e06294e4c063c163def563ac8e7ba62696bf2a33a2d53ea","observation_id":"4a8cf1d6-b39c-4c2f-99a7-3f947a85aa50","resolution":{"observed_at":"2026-06-28T14:42:17.759009Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-22T17:23:02.719307+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T17:23:02.719307+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.52202/079017-0324","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Peter Jansen, Marc-Alexandre Côté, Tushar Khot, Erin Bransom, Bhavana Dalvi Mishra, Bodhisattwa Prasad Majumder, Oyvind Tafjord, and Peter Clark","venue":null,"work_id":"d751f9bb-30cc-467a-b2d1-dbf366f458de","year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:d862cae400d1e2c86570e9d5b51f6b23229a122851374538a769ae4ebfc9d96b","observation_id":"4f0dfe32-d5f1-4b67-b079-8ce63aaa6fc0","resolution":{"observed_at":"2026-06-28T14:42:17.759497Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.14654","last_updated":"2025-02-12T05:32:07Z","snapshot_observed_at":"2026-08-07T23:39:35.336216Z","submitted_at":"2025-01-24T17:21:01Z","title":"MedAgentBench: A Realistic Virtual EHR Environment to Benchmark Medical LLM Agents","version":2},"cited_work":{"arxiv_id":"2501.14654","doi":"10.48550/arxiv.2501.14654","metadata_source":"arxiv_reference","pith_arxiv_id":"2501.14654","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"and Geng, Gloria and Park, Danny and Zou, James and Ng, Andrew Y","venue":"ArXiv.org","work_id":"52ee24a4-e815-4788-8c57-f947197cc09e","year":2025},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2501.14654","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:13a53e99f26177912886dd88eedff57a6ab7cc25c52913309c7f7caa08b442f7","observation_id":"5bb0b44e-83f6-4333-80b3-5cdc13f30f2c","resolution":{"observed_at":"2026-07-01T23:06:21.084048Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Jimenez, John Yang, Alexander Wettig, Shunyu Yao, Kexin Pei, Ofir Press, and Karthik Narasimhan","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:7761ea3569230987c0a36ff10b882c7987d70c430e4df7e3d6bb0f0e668e30d0","observation_id":"dc4ee18a-8f2e-4710-858c-23fe92c505c5","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3390/app11146421","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"What disease does this patient have? A large-scale open domain question answering dataset from medical exams.Applied Sciences, 11(14):6421","venue":"Applied Sciences","work_id":"8f5486db-de55-4505-948e-e05912d36328","year":2021},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:5eb2e8f49b4729131623c195473c464d181a7f87022df9afe57f9b0a6f4c6a7c","observation_id":"fd9518b7-5c28-4fe0-9942-fe06e9d3a0a6","resolution":{"observed_at":"2026-06-28T14:42:17.757611Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-30T11:25:12.258303+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-30T11:25:12.258303+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/d19-1259","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PubMedQA: A Dataset for Biomedical Research Question Answering","venue":null,"work_id":"3b7b483f-8a9e-48d0-9c59-bc4a0269ab01","year":2019},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:da5d87a540b03fe85d77a11f72755f18a6c791acaf92cbe39b0d58ff5c6c3426","observation_id":"debc29f6-f8ab-4e62-a39e-55f42b366d8f","resolution":{"observed_at":"2026-06-28T14:42:17.794977Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-07T20:38:13.077697+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-07T20:38:13.077697+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Johnson et al","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:be1d2c90dd2b7ae829390c477879026ec0afa087aa7d859694e6ba951391df41","observation_id":"d295afe1-aa5b-4b02-af5b-5d49c0ec636a","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"BCCD: Blood cell count and detection dataset.https://huggingface","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:ea621e07d95e81c8b4f67982ef37d7dc3e984589151bf66269490efe71fc4d7c","observation_id":"14516445-2559-4eee-b310-f9d479f3e7e2","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/sdata.2018.251","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URLhttps://www.nature.com/articles/sdata2018251","venue":"Scientific Data","work_id":"7b69c607-ae16-42bd-8ad3-a321ba6fbf5a","year":2018},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:51b45c80a2a995ed160b3669c52aeb9fe92a31e9e527373c027d9beb6a839dfa","observation_id":"95b142f1-7c7c-47b7-81d4-bfeedf8b185c","resolution":{"observed_at":"2026-06-28T14:42:17.779613Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-22T13:23:18.139766+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-22T13:23:18.139766+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.19319","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:59:45.712211Z","title":"Fhir-agentbench: Benchmarking llm agents for realistic interoperable ehr question answering","venue":null,"work_id":"a8e8d4c4-75eb-43af-a4fb-7b420cabb12c","year":2025},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:c8457166409fda94e37b24849aed307266d133781043e0a256fe681697b79168","observation_id":"96c5dbe3-c811-4997-bc51-0a4153af0235","resolution":{"observed_at":"2026-07-01T23:06:21.165966Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.13918","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T23:06:21.158806Z","title":"Agen- tehr: Advancing autonomous clinical decision-making via retrospective summarization","venue":null,"work_id":"919f4ec2-baf2-47f6-8e69-52986548decd","year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:b24eefea55515eacb291225f0fed63d498abc4e968efec66531ec98ca7939dbf","observation_id":"0678e7a6-5cc3-4662-9312-efb1cc2f8ee7","resolution":{"observed_at":"2026-07-01T23:06:21.161668Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"ROUGE: A package for automatic evaluation of summaries","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:e1dc7d03a4b2e783f4efba50c968a147d4c5bd1dc0286ff037f9156ec7fa44b0","observation_id":"fa3c2fa9-f376-443e-a6dc-d47b38dd8d10","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2023.102611","doi":"10.1016/j.artmed.2023.102611","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Artificial Intelligence in Medicine143, 102611 (2023)","venue":"Artificial Intelligence in Medicine","work_id":"71cce35a-b667-4c8b-885b-80374c40a88f","year":2023},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:777e8bb06af26d236886aa46806520aaa32f89412d48e731ccd572258b103ee9","observation_id":"bcc2cf39-8f1b-4ae4-9276-7523e367290f","resolution":{"observed_at":"2026-06-28T14:42:17.770721Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1016/j.media.2017.07.005","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"van der Laak, Bram van Ginneken, and Clara I","venue":"Medical Image Analysis","work_id":"7e9ffc51-3092-4bb1-aec4-398a570b89fe","year":2017},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:0827cfdbf1971e79690a115799fff19fac23382d217d63885172760f8834db6d","observation_id":"0655a30a-a525-403a-9c3b-e189e3648aa1","resolution":{"observed_at":"2026-06-28T14:42:17.777323Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-03T14:08:21.515918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-03T14:08:21.515918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"SLAKE: A semantically-labeled knowledge-enhanced dataset for medical visual question answering","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:fe886fe3ca5e710d6ecb4a2f262cf2eb65e024cd745d059ad89a370f065fa54b","observation_id":"048f4a82-b5da-444b-bad5-e7c41842c503","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"8211.2021","doi":"10.1109/isbi48211.2021.9433826","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"URL https://arxiv.org/abs/2102.09542","venue":null,"work_id":"b02cf3ea-367a-4275-a0fb-9e0ecd02f6a1","year":2021},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:d62701a1180d39adca9de653ec1cf0368d6f2969bb4770995d5222614cf14426","observation_id":"e17750a0-ac70-4e49-ad05-c689ee71065a","resolution":{"observed_at":"2026-06-28T14:42:17.777443Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-23T20:54:09.717758+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T20:54:09.717758+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.02240","last_updated":"2026-05-04T05:32:25Z","snapshot_observed_at":"2026-08-05T13:22:08.032276Z","submitted_at":"2026-05-04T05:32:25Z","title":"PhysicianBench: Evaluating LLM Agents in Real-World EHR Environments","version":1},"cited_work":{"arxiv_id":"2605.02240","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.02240","snapshot_observed_at":"2026-07-01T23:06:21.130346Z","title":"PhysicianBench: Evaluating LLM Agents in Real-World EHR Environments","venue":"cs.AI","work_id":"f1c59c1f-7608-492b-be64-e6765077b3ab","year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2605.02240","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:9fd10725246e5304eb278e9a069422b7d2701e997bea79a89a85ac587f23ef5b","observation_id":"a5c2a0a7-81d2-4edc-81a4-6ab1bcb48d34","resolution":{"observed_at":"2026-07-01T23:06:21.132384Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Agentbench: Evaluating LLMs as agents","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:c04f81f8c4c2f065ea828fa54c4da3e52f1790d6da5736f4dff10e0d3e852577","observation_id":"af86cd11-889c-4d79-9bb2-e5dd51d07dd3","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06292","last_updated":"2024-09-01T00:41:18Z","snapshot_observed_at":"2026-07-06T18:59:43.564435Z","submitted_at":"2024-08-12T16:58:11Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","version":3},"cited_work":{"arxiv_id":"2408.06292","doi":"10.48550/arxiv.2408.06292","metadata_source":"pith","pith_arxiv_id":"2408.06292","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"The AI Scientist: Towards Fully Automated Open-Ended Scientific Discovery","venue":"cs.AI","work_id":"56b6b58d-e73a-4317-896e-36ac5f84e957","year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2408.06292","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:39bfb2a06a7198d65bf0f04e9e4d7e11218ca11e84608f288d56055055469a16","observation_id":"fa30672c-3eca-4589-9219-8bd1f94a5804","resolution":{"observed_at":"2026-07-01T23:06:21.090745Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-25T19:23:20.611352+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T19:23:20.611352+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.13178","last_updated":"2024-12-23T20:12:48Z","snapshot_observed_at":"2026-07-06T17:19:44.130417Z","submitted_at":"2024-01-24T01:51:00Z","title":"AgentBoard: An Analytical Evaluation Board of Multi-turn LLM Agents","version":2},"cited_work":{"arxiv_id":"2401.13178","doi":"10.48550/arxiv.2401.13178","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.13178","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"NeurIPS / arXiv preprint 2401.13178","venue":"arXiv (Cornell University)","work_id":"64c5309b-a802-40af-bb4b-4fb9ecf315d8","year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2401.13178","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:b40c23a09d55d420fcfd8dcd4fddb3babd0ce4aff1a7ee15e52191096eba308b","observation_id":"6de4b676-0d25-434b-804d-9b7c2be9a0eb","resolution":{"observed_at":"2026-07-01T23:06:21.094083Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T08:23:32.642283+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.11868","last_updated":"2026-01-17T01:29:30Z","snapshot_observed_at":"2026-07-06T22:41:58.373427Z","submitted_at":"2026-01-17T01:29:30Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","version":1},"cited_work":{"arxiv_id":"2601.11868","doi":"10.48550/arxiv.2302.01973","metadata_source":"pith","pith_arxiv_id":"2601.11868","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Terminal-Bench: Benchmarking Agents on Hard, Realistic Tasks in Command Line Interfaces","venue":"cs.SE","work_id":"0624be05-1d97-4fd6-8300-b04b8a3ab04b","year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2601.11868","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:24eb7325ff92cc3bd16dcc9441adca0b1358bfbff953f517bea86f596908797e","observation_id":"2221835f-028b-49fb-aa83-7f9ddd932217","resolution":{"observed_at":"2026-07-01T23:06:21.097857Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"GAIA: a benchmark for general AI assistants","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:ef0ae30596cb50fe5b075761ea086c305fb99f7bad29f1695a646de07c72d8f0","observation_id":"c420184c-a22a-4de6-8317-a90931d0e54e","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"The MiniMax-M2 series: Mini activations unleashing max real-world intelligence,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:906f936575c12ef26c9f0406a628e5bc450db91af81b756bf2ee0e4be431903e","observation_id":"5ad15700-7806-4109-8db1-04cbc3e90238","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.26494","last_updated":"2026-07-30T05:04:36Z","snapshot_observed_at":"2026-08-06T03:12:19.331370Z","submitted_at":"2026-05-26T03:16:11Z","title":"The MiniMax-M2 Series: Mini Activations Unleashing Max Real-World Intelligence","version":2},"cited_work":{"arxiv_id":"2605.26494","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.26494","snapshot_observed_at":"2026-07-10T13:57:07.070944Z","title":"The MiniMax-M2 Series: Mini Activations Unleashing Max Real-World Intelligence","venue":"cs.AI","work_id":"84aa8451-9942-461d-a1b6-ceb9936fd774","year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2605.26494","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:cfc119e13d3a0d04f85ce4f8016965c5426a26a73a357f100291e96941bf44b4","observation_id":"6de01c2b-910e-475c-8523-985dab72257b","resolution":{"observed_at":"2026-07-01T23:06:21.105338Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"grazpedwri-dx/1482519","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T23:06:21.121873Z","title":"GRAZPEDWRI-DX: A pediatric wrist radiograph dataset.https:// figshare.com/articles/dataset/GRAZPEDWRI-DX/14825193, 2022","venue":null,"work_id":"448e5d0e-2589-4cdf-87f5-74290929d543","year":2022},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:ac0e5bf6bc95163c69cfc2fe70b5c6f01a08bc15dad1e22b860e09a01bf3fbcc","observation_id":"4e579121-6056-48b5-a863-c1081be727e7","resolution":{"observed_at":"2026-07-01T23:06:21.124512Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"MLGym: A new framework and benchmark for advancing AI research agents","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:9e54e383184cb0d33a1995955fff864a99c70e1b1c369fe560385ba5e681c546","observation_id":"d00ab522-7069-4605-b6c4-1e72fcec9d72","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Nguyen et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:cf0ddbec4232b4027c657aaa8910f031c648ff97478c6a8eeab012540e020ce2","observation_id":"0f446f5a-7692-4f06-a8c7-b7233d2fe062","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"GPT-5.4 Thinking system card.https://deploymentsafety.openai","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:32e8094f33ec07c385d70d8fe0154807e1c7561c75abc61113bb0016394760d5","observation_id":"a1190a0f-7bf4-4208-86aa-9906fa448477","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"MedMCQA: A large- scale multi-subject multi-choice dataset for medical domain question answering","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:1dc4b66c43533cd12f9b40737dbbdecb719f7a37d19fd5e58cefe1bba07f1ad2","observation_id":"a8614ddf-d82d-4c75-b192-4cd842a43129","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"3083.107313","doi":"10.3115/1073083.1073133","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"doi:10.3115/1073083.1073135 , editor =","venue":null,"work_id":"7a0e7f56-7c92-470e-b7bf-2e9974bf9a93","year":2002},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:7e6697690d4895d18acade865a9623387306e55f87e82d9dcf73728f026f2c7b","observation_id":"c9d6593a-a47c-42da-9395-21615de50368","resolution":{"observed_at":"2026-06-28T14:42:17.787208Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-11T19:19:47.730132+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T19:19:47.730132+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Qwen3.5: Towards native multimodal agents.https://qwen.ai/blog? id=qwen3.5, February 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:b35e5b1234caad6bf5babcd7a3a3118b594e92bd2dc1b9f1b1acef70f6e08142","observation_id":"2493b696-f497-44cb-920a-088e51287699","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"AeroPath: Airway segmentation dataset.https://github.com/ raidionics/AeroPath, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:4625da47d7adf6219f22e937549c34c5e8c72911d4492b0859ee378fc6c0e96a","observation_id":"10655f46-a0a7-4dd6-b681-2021c5ed712d","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1109/cvpr.2016.91","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2016, in 2016 IEEE Conference on Computer Vision and Pattern Recognition (CVPR), 779–788, doi: 10.1109/CVPR.2016.91","venue":null,"work_id":"37ab4f11-9f69-480d-aab9-e7d9826c586d","year":2016},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:fe68941f6c0e557a927a415d003eef053b5376f62bd2f656c21f135a7c230c2e","observation_id":"44d77347-b30d-4b3c-99c9-a2c40e0e1ecc","resolution":{"observed_at":"2026-06-28T14:42:17.792926Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-07-12T12:50:00.152972+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T12:50:00.152972+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Faster R-CNN: Towards real-time object detection with region proposal networks","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:e070831dd4dccb4e88f0403807aff8079d490fd882e8635c2c1ea88344f141de","observation_id":"2f6e6479-e96c-4d59-a6e9-9353d5a8ba7e","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"U-Net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:d48a4972bd7206476af6ca87fddc2216f383af3551061d3888a886e1d6cc43c6","observation_id":"502e2985-f5d7-4ed1-b2d0-e4300536f05d","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07960","last_updated":"2025-05-25T02:19:37Z","snapshot_observed_at":"2026-07-30T08:34:47.046912Z","submitted_at":"2024-05-13T17:38:53Z","title":"AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments","version":5},"cited_work":{"arxiv_id":"2405.07960","doi":"10.48550/arxiv.2405.07960","metadata_source":"pith","pith_arxiv_id":"2405.07960","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments","venue":"cs.HC","work_id":"418a0992-6f06-45f9-958d-cfdfc51c72af","year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2405.07960","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:87ea42f9d0f0fac1f989d004c2bf2e82e3531fe8d6b59de0f9f98c91703670b3","observation_id":"3d584db4-dd51-498c-8ad2-204d81e17450","resolution":{"observed_at":"2026-07-01T23:06:21.136145Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Ehragent: Code empowers large language models for few-shot complex tabular reasoning on electronic health records","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:6bcd76f1e9253cbafba170f79067bc0bd58d700b016cb0a7c5cd9fb97686e52c","observation_id":"adffbb9c-e4c7-4770-8d2d-637f9b4d5274","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"Siegel, Sayash Kapoor, Nitya Nadgir, Benedikt Stroebl, and Arvind Narayanan","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:000f5d9a53231adf1a658ede6f37484c716a9ff2d1d565a11a9658e3055fc079","observation_id":"ba478fe3-80d4-4c2f-98f5-56617b76c36b","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41586-023-06291-2","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T21:07:34.713492Z","title":"Large Language Models Encode Clinical Knowledge","venue":"Nature","work_id":"bd063ed4-6265-4e11-8cf5-208f7e1432ac","year":2023},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:6d04edda04402c186011ce2b7a33f25b5d6eaf894a02157245cc733add37a797","observation_id":"63f1eba0-6a5d-4c9d-9af3-1a65f843f1bb","resolution":{"observed_at":"2026-06-28T14:42:17.789287Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[{"edge_observation":{"observed_at":"2026-07-11T03:19:08.01801+00:00","source":"paper_reference_links","state":"open"},"event_date":"2023-07-27","event_type":"correction","notice_doi":"10.1038/s41586-023-06455-0","provenance":{"observed_at":"2026-07-11T03:08:19.417011+00:00","source":"crossref","source_record_id":"10.1038/s41586-023-06455-0->10.1038/s41586-023-06291-2:correction"}}],"reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"PaperBench: Evaluating AI’s ability to replicate AI research,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:e12f588adae7eb21f492dea426e37bcda2550e489c58d56882ef4fe8c48ad924","observation_id":"7c25706f-4bc9-4912-bb3c-7f3ddaf77de6","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.01848","last_updated":"2025-04-07T12:15:49Z","snapshot_observed_at":"2026-07-06T21:03:06.857885Z","submitted_at":"2025-04-02T15:55:24Z","title":"PaperBench: Evaluating AI's Ability to Replicate AI Research","version":3},"cited_work":{"arxiv_id":"2504.01848","doi":"10.1126/science.adp7429","metadata_source":"pith","pith_arxiv_id":"2504.01848","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PaperBench: Evaluating AI's Ability to Replicate AI Research","venue":"cs.AI","work_id":"7db23490-3dd0-4cfa-a75c-5537ee36dcc2","year":2025},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2504.01848","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:b8682ed6f0ae6216555d07c0c0aa1eaa10a0be4b29db5e2bfee1c81abbd3ef2b","observation_id":"d0cdbdbb-f07d-48ae-b274-11c0b1372d11","resolution":{"observed_at":"2026-07-01T23:06:21.152849Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15072","last_updated":"2024-02-19T07:02:15Z","snapshot_observed_at":"2026-08-07T23:39:17.945301Z","submitted_at":"2023-05-24T11:55:50Z","title":"PathAsst: A Generative Foundation AI Assistant Towards Artificial General Intelligence of Pathology","version":2},"cited_work":{"arxiv_id":"2305.15072","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2305.15072","snapshot_observed_at":"2026-07-01T23:06:21.175652Z","title":"PathAsst: A generative foundation AI assistant towards artificial general intelligence of pathology, 2023","venue":null,"work_id":"a30efef8-2d90-47d8-a527-1c16e6334774","year":2023},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2305.15072","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:3a1b7b24aac5eb980073ad191a3812ef43c69ec302b29d36a3403d9036e985aa","observation_id":"4b232d4e-ed5c-43c4-bdb2-0c6aabe24215","resolution":{"observed_at":"2026-07-01T23:06:21.179269Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"MedXpertQA-MM: Multimodal expert medical question answering.https: //huggingface.co/datasets/TsinghuaC3I/MedXpertQA, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:0fe0bf1d3c00a1510da5d5b991697a9cc2c59ab3d6dcd1fbbff8105706e2808c","observation_id":"f30b508f-5116-4990-a5a4-44b5e17c7b49","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2003.819861","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T13:47:05.725412Z","title":"Bovik, Hamid R","venue":null,"work_id":"a9ba8a9e-c00a-45ff-9d73-a0ae0919d283","year":2004},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:db33ded3bd9adbc30deabefb2486446ca9a4ad84d5e2a8586f8261be5e5c3fe4","observation_id":"aef18d50-9cf6-4af0-bfb7-ffefed375d28","resolution":{"observed_at":"2026-06-28T14:42:17.774755Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"TotalSegmentator: Robust segmentation of 104 anatomical structures in CT.https://github.com/wasserth/TotalSegmentator, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:8d43bdf46a9c6714460bfc0581232631d03d125fc7b410e16c13c2aae2f1b4dd","observation_id":"7e723958-2c50-42dc-97fa-2370b1ae0c16","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07972","last_updated":"2024-05-30T08:55:12Z","snapshot_observed_at":"2026-08-07T10:10:50.201348Z","submitted_at":"2024-04-11T17:56:05Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","version":2},"cited_work":{"arxiv_id":"2404.07972","doi":"10.48550/arxiv.2404.07972","metadata_source":"pith","pith_arxiv_id":"2404.07972","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"OSWorld: Benchmarking Multimodal Agents for Open-Ended Tasks in Real Computer Environments","venue":"cs.AI","work_id":"793d9419-734d-45fe-9f51-d4c5a3a57cf8","year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2404.07972","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:e77e5d25bbb07f762f236b1a6b3181cc6dd5e485c5faf250e2f67644219385d0","observation_id":"d25a1708-869f-4877-94de-43d5f06fc7b7","resolution":{"observed_at":"2026-07-01T23:06:21.120068Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-19T22:22:21.817655+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-19T22:22:21.817655+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1038/s41597-022-01721-8","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Medmnist v2 - a large-scale lightweight benchmark for 2d and 3d biomedical image classification.Scientific Data, 10(1), January 2023.doi:10.1038/s41597-022-01721-8","venue":"Scientific Data","work_id":"f0443dae-ac41-4c2c-96cc-9d6fad99d14c","year":2023},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:e030da35915c3e154c21c97ef57ec0cb38284484ef3647df74b14d0c72109067","observation_id":"fe0aff11-89f6-4512-8fc3-45181eb90bef","resolution":{"observed_at":"2026-06-28T14:42:17.791073Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-01T05:09:01.650021+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-01T05:09:01.650021+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.15711","last_updated":"2024-10-21T15:45:31Z","snapshot_observed_at":"2026-08-05T17:32:28.104029Z","submitted_at":"2024-07-22T15:18:45Z","title":"AssistantBench: Can Web Agents Solve Realistic and Time-Consuming Tasks?","version":2},"cited_work":{"arxiv_id":"2407.15711","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.15711","snapshot_observed_at":"2026-07-08T16:15:06.145782Z","title":"2407.15711 , archivePrefix=","venue":"cs.CL","work_id":"e104d3d8-30eb-452f-8dcf-7b49d40f651c","year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/2407.15711","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:dd035455ea36b1eb5e48aaa635333b3bfa2549885aacbb4804324f96e3a2b906","observation_id":"e4d8356c-9d47-449f-9de3-f7a8412bd025","resolution":{"observed_at":"2026-07-01T23:06:21.144889Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.16964","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T20:40:07.513169Z","title":"Medframeqa: A multi-image medical vqa benchmark for clinical reasoning","venue":null,"work_id":"288f899f-01a2-48e4-809e-7b2281450a1b","year":2025},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:851776308959be225a1070253d996761cc37b8f139c0df63a26bb94b5816dd19","observation_id":"eb3e034f-7e32-4625-a8f4-680917d30ebc","resolution":{"observed_at":"2026-07-01T23:06:21.169959Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1811.08839","last_updated":"2019-12-11T10:31:39Z","snapshot_observed_at":"2026-08-01T03:38:56.284253Z","submitted_at":"2018-11-21T17:32:14Z","title":"fastMRI: An Open Dataset and Benchmarks for Accelerated MRI","version":2},"cited_work":{"arxiv_id":"1811.08839","doi":"10.1038/s41467-021-25431-8","metadata_source":"pith","pith_arxiv_id":"1811.08839","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"fastMRI: An Open Dataset and Benchmarks for Accelerated MRI","venue":"cs.CV","work_id":"1935feba-42c8-49e7-8dcd-5bae11b83a60","year":2018},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"cited_paper":"/paper/1811.08839","citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:ada92d299a2e2b911e38632803ac0ee7955e4f56618b6acb1311c3a496b641ea","observation_id":"62ecbb48-0675-42cc-8146-fbbea6d31200","resolution":{"observed_at":"2026-07-01T23:06:21.173834Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T14:38:40.017263Z","title":"open-source","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-28T14:38:40.017263Z"},"links":{"citing_paper":"/paper/2606.01961"},"observation_digest":"sha256:872f3a4bcf5c3bdd8c2df9a270190b289936b0fcc0a20ed7dcbfd9bc678bee1f","observation_id":"c5f3758a-fe32-4f43-b745-a231f9d1e3d3","resolution":{"observed_at":"2026-06-28T14:38:40.017263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.01961","last_updated":"2026-06-03T05:43:27Z","latest_version":2,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T15:01:13.401479Z","submitted_at":"2026-06-01T09:22:55Z","title":"AutoMedBench: Towards Medical AutoResearch with Agentic AI Models"},"reference_resolution":{"displayed":80,"state_counts":{"malformed_identifier":1,"metadata_mismatch":13,"parse_uncertain":0,"unresolved":35,"verified_exact":31,"verified_fuzzy":0},"total_outbound_references":80},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 80 of 80 outbound references and 1 inbound Pith citation observation for arXiv:2606.01961."}