{"as_of":"2026-08-19T01:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:07ad4a8eae99536566de51f8c8961a853dc58a67170ad82030106cbba136e159","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T11:11:20.492320Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T18:57:31.629931Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-08-11T11:11:20.492320Z","title":"Quantifying the reasoning abilities of llms on real-world clinical cases","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2412.15748","last_updated":"2025-07-28T13:13:02Z","snapshot_observed_at":"2026-08-14T22:03:56.539797Z","submitted_at":"2024-12-20T10:06:52Z","title":"Critique of Impure Reason: Unveiling the reasoning behaviour of medical Large Language Models","version":2},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-11T11:11:20.492320Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2412.15748"},"observation_digest":"sha256:6568653894f8c3155d80a2b860ba5326b8392c71c08fdb9df57ffe360cc11880","observation_id":"8170ad43-6136-49e0-89f3-97328b26bc02","resolution":{"observed_at":"2026-08-11T11:11:20.492320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-08-07T15:42:23.341138Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14107","last_updated":"2026-08-17T08:06:21Z","snapshot_observed_at":"2026-08-19T01:19:58.393661Z","submitted_at":"2025-05-20T09:14:53Z","title":"DiagnosisArena: Benchmarking Diagnostic Reasoning for Large Language Models","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:23.341138Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2505.14107"},"observation_digest":"sha256:7d9140a079de86249d78ee3ae1407537386be1e9a2e419d6df3658c938c8a3e1","observation_id":"c52ef2d4-c7d1-47c7-8cb6-135021e83135","resolution":{"observed_at":"2026-08-07T15:42:23.341138Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":"2503.04691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-07-10T18:57:31.629931Z","title":"Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever, and 1 others","venue":"cs.CL","work_id":"20205e1a-12c8-4f86-921f-a452ca97c954","year":2025},"citing_paper":{"arxiv_id":"2505.14558","last_updated":"2026-04-03T16:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T16:15:30Z","title":"R2MED: A Benchmark for Reasoning-Driven Medical Retrieval","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-22T13:52:15.835379Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2505.14558"},"observation_digest":"sha256:c80c7364507dbfe3c385161d468f4e0e9ef5564c351305e302963b7814b8a9fa","observation_id":"101fbe55-964d-4a34-af37-261a86becbc3","resolution":{"observed_at":"2026-05-22T13:54:53.047533Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-08-07T11:50:15.401898Z","title":"arXiv preprint arXiv:2503.04691, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.01257","last_updated":"2025-06-02T02:17:04Z","snapshot_observed_at":"2026-08-14T21:01:21.268956Z","submitted_at":"2025-06-02T02:17:04Z","title":"DeepSeek in Healthcare: A Survey of Capabilities, Risks, and Clinical Applications of Open-Source Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T11:50:15.401898Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2506.01257"},"observation_digest":"sha256:14989e9a41cd583b9d5f303eef26127f5f7f6378c03804cde8dcaa50932b4444","observation_id":"6a0942ad-9a9b-499b-84cf-9c9fc39cd225","resolution":{"observed_at":"2026-08-07T11:50:15.401898Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-08-06T22:09:07.229393Z","title":"Quantifying the reasoning abilities of llms on real-world clinical cases","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.22567","last_updated":"2025-06-27T18:28:57Z","snapshot_observed_at":"2026-08-15T04:20:48.820267Z","submitted_at":"2025-06-27T18:28:57Z","title":"Unifying Biomedical Vision-Language Expertise: Towards a Generalist Foundation Model via Multi-CLIP Knowledge Distillation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T22:09:07.229393Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2506.22567"},"observation_digest":"sha256:8cfaea6cf8fb3c731a65484982e5c835fc787e3a08010b00b38ebc763688074d","observation_id":"3391c1e2-2fd8-4417-a6ec-7c27e67d08fa","resolution":{"observed_at":"2026-08-06T22:09:07.229393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-08-06T20:58:50.899730Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.03001","last_updated":"2025-07-02T00:53:54Z","snapshot_observed_at":"2026-08-18T07:29:48.498378Z","submitted_at":"2025-07-02T00:53:54Z","title":"Evaluating Hierarchical Clinical Document Classification Using Reasoning-Based LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T20:58:50.899730Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2507.03001"},"observation_digest":"sha256:82386c87e8131588f6265d2c9b98e4d66d8c62ed122f325817c9396cb541e905","observation_id":"27d635b9-6710-4f2c-985b-0ce87cf70f69","resolution":{"observed_at":"2026-08-06T20:58:50.899730Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-08-04T10:23:41.345505Z","title":"Quantifying the reasoning abilities of llms on real-world clinical cases.arXiv preprint arXiv:2503.04691, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.10185","last_updated":"2026-05-27T14:30:07Z","snapshot_observed_at":"2026-08-15T13:47:11.331942Z","submitted_at":"2025-10-11T11:48:57Z","title":"Auditing medical multi-agent AI reveals risks of false consensus","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-04T10:23:41.345505Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2510.10185"},"observation_digest":"sha256:9819d4175b660d3d953f39728a45fe0a66f96d946e35e8676a165c30daf91b9b","observation_id":"9bfa7835-302a-4364-84c1-b7861e618948","resolution":{"observed_at":"2026-08-04T10:23:41.345505Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-08-03T10:55:09.481083Z","title":"Timo Schick, Jane Dwivedi-Yu, Roberto Dessì, Roberta Raileanu, Maria Lomeli, Eric Hambro, Luke Zettle- moyer, Nicola Cancedda, and Thomas Scialom","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.08173","last_updated":"2026-06-02T11:13:10Z","snapshot_observed_at":"2026-08-13T09:02:36.940762Z","submitted_at":"2026-01-13T03:09:18Z","title":"The Agent's First Day: Benchmarking Learning, Exploration, and Scheduling in the Workplace Scenarios","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T10:55:09.481083Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2601.08173"},"observation_digest":"sha256:4920f0d4496002e238f9483c47e9e687fe087ddcad74fe8137e175089f1b6dc1","observation_id":"04bebf6d-5e50-4884-87b1-dc8a6ec1079c","resolution":{"observed_at":"2026-08-03T10:55:09.481083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":"2503.04691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-07-10T18:57:31.629931Z","title":"Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever, and 1 others","venue":"cs.CL","work_id":"20205e1a-12c8-4f86-921f-a452ca97c954","year":2025},"citing_paper":{"arxiv_id":"2605.09584","last_updated":"2026-05-10T14:51:31Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T14:51:31Z","title":"CLR-voyance: Reinforcing Open-Ended Reasoning for Inpatient Clinical Decision Support with Outcome-Aware Rubrics","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-12T04:32:16.930291Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2605.09584"},"observation_digest":"sha256:e13dd23be5e4a022cdd5eac55ea4ec997b49c740290d309bf2008b9ffba98946","observation_id":"3901abe2-2aac-4f61-bcfb-e0a638fcb523","resolution":{"observed_at":"2026-05-12T06:11:23.757993Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":"2503.04691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-07-10T18:57:31.629931Z","title":"Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever, and 1 others","venue":"cs.CL","work_id":"20205e1a-12c8-4f86-921f-a452ca97c954","year":2025},"citing_paper":{"arxiv_id":"2605.30637","last_updated":"2026-05-28T22:38:26Z","snapshot_observed_at":"2026-08-15T02:58:19.749294Z","submitted_at":"2026-05-28T22:38:26Z","title":"EHRBench: An Automated and Reliable EHR-based Benchmark for Clinical Decision Making with LLMs","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-29T06:41:06.828814Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2605.30637"},"observation_digest":"sha256:bfe3caa673d45b5af5097f7a311345da10741c64a0b7180e596fe65ec5aa430a","observation_id":"c07a3434-317f-41ed-b803-eef1a0dcf3c0","resolution":{"observed_at":"2026-06-29T06:43:10.358216Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":"2503.04691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-07-10T18:57:31.629931Z","title":"Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever, and 1 others","venue":"cs.CL","work_id":"20205e1a-12c8-4f86-921f-a452ca97c954","year":2025},"citing_paper":{"arxiv_id":"2606.01094","last_updated":"2026-05-31T08:31:36Z","snapshot_observed_at":"2026-07-06T23:41:43.820102Z","submitted_at":"2026-05-31T08:31:36Z","title":"CAREAgent: Clinical Agent with Structured Reasoning and Tool-Integrated for Order Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T17:42:53.473531Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2606.01094"},"observation_digest":"sha256:67bf221ab1876a41b55cabd30abf60335cba465ca2c73b00eabc9b3d1036239b","observation_id":"b05bead6-4bdf-4d64-a396-4a5ba9978ab3","resolution":{"observed_at":"2026-07-01T20:46:14.129590Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":"2503.04691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-07-10T18:57:31.629931Z","title":"Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever, and 1 others","venue":"cs.CL","work_id":"20205e1a-12c8-4f86-921f-a452ca97c954","year":2025},"citing_paper":{"arxiv_id":"2606.03157","last_updated":"2026-06-02T05:09:18Z","snapshot_observed_at":"2026-08-01T10:50:39.590151Z","submitted_at":"2026-06-02T05:09:18Z","title":"ClinicalMC: A Benchmark for Multi-Course Clinical Decision-Making with Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T10:16:13.117505Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2606.03157"},"observation_digest":"sha256:69fdebf319ca40337713085a8a25e92782e737cde64cc4f98a26063055f64703","observation_id":"358ce634-a5bd-4850-9452-d6c24c60f1ed","resolution":{"observed_at":"2026-07-02T03:06:30.539563Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":"2503.04691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-07-10T18:57:31.629931Z","title":"Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever, and 1 others","venue":"cs.CL","work_id":"20205e1a-12c8-4f86-921f-a452ca97c954","year":2025},"citing_paper":{"arxiv_id":"2606.29746","last_updated":"2026-06-29T03:42:48Z","snapshot_observed_at":"2026-08-12T05:33:30.886820Z","submitted_at":"2026-06-29T03:42:48Z","title":"DEEPMED Search: An Open-Source Agentic Platform for Medical Deep Research with Introspective Verification","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T06:49:56.771944Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2606.29746"},"observation_digest":"sha256:4dfd49c36205f20389a0426f981528cc253c2cd90487fa72faa7bd3f62c81f49","observation_id":"a791188c-d2d4-48f5-9b16-d9e86379b3c3","resolution":{"observed_at":"2026-06-30T06:54:20.477832Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":"2503.04691","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-07-10T18:57:31.629931Z","title":"Alec Radford, Jeffrey Wu, Rewon Child, David Luan, Dario Amodei, Ilya Sutskever, and 1 others","venue":"cs.CL","work_id":"20205e1a-12c8-4f86-921f-a452ca97c954","year":2025},"citing_paper":{"arxiv_id":"2607.07761","last_updated":"2026-07-08T15:19:37Z","snapshot_observed_at":"2026-08-06T23:41:57.869470Z","submitted_at":"2026-07-08T15:19:37Z","title":"Aligning Clinical Needs and AI Capabilities: A Survey on LLMs for Medical Reasoning","version":1},"reference_index":153,"source":"pdf_text","source_observed_at":"2026-07-10T18:50:22.827472Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2607.07761"},"observation_digest":"sha256:18f97d49fa1ebd0e8f66223b80d3e7c32ba2474d98110f2780b559f04c5e93ae","observation_id":"c8524ab9-926f-454b-925d-b934f8448ea7","resolution":{"observed_at":"2026-07-10T18:57:31.631179Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-07-14T06:30:16.612345Z","title":"Quantifying the reasoning abilities of llms on real-world clinical cases.arXiv preprint arXiv:2503.04691, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.11175","last_updated":"2026-08-12T13:35:16Z","snapshot_observed_at":"2026-08-17T11:38:26.224799Z","submitted_at":"2026-07-13T07:16:50Z","title":"The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Autonomy","version":1},"reference_index":200,"source":"pdf_text","source_observed_at":"2026-07-14T06:30:16.612345Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2607.11175"},"observation_digest":"sha256:fb4c227ad09cc9d32fd30be6a2a7b0c58f910b1a219ede35bbc5b309e16dca6f","observation_id":"a57514bb-f553-464b-8ca2-c5056fda13c6","resolution":{"observed_at":"2026-07-14T06:30:16.612345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.04691","snapshot_observed_at":"2026-08-01T16:12:28.284354Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.18086","last_updated":"2026-07-20T15:53:02Z","snapshot_observed_at":"2026-08-15T21:46:50.882026Z","submitted_at":"2026-07-20T15:53:02Z","title":"Judge-dependent safety gains and model-specific helpfulness costs of evidence-sufficiency prompting in clinical LLMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T16:12:28.284354Z"},"links":{"cited_paper":"/paper/2503.04691","citing_paper":"/paper/2607.18086"},"observation_digest":"sha256:f9ebf4c040cace191cbf0c177b1786f4586df9b13b290b3f774075cabb102d8f","observation_id":"066c6df1-6159-4b8b-bfad-ee6732c40a38","resolution":{"observed_at":"2026-08-01T16:12:28.284354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2503.04691/citation-record","integrity":"/paper/2503.04691/integrity","json":"/paper/2503.04691/citation-record.json","paper":"/paper/2503.04691"},"outbound":[],"paper":{"arxiv_id":"2503.04691","last_updated":"2025-03-10T17:28:31Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T12:52:24.173951Z","submitted_at":"2025-03-06T18:35:39Z","title":"Quantifying the Reasoning Abilities of LLMs on Real-world Clinical Cases"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2503.04691."}