{"as_of":"2026-08-20T21:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0b2bcbd27e288e0d2762af62ccbeddec8ab7a73ffbcc207e0d7df41d72b3841d","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":7,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":7,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":7,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":7,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T20:56:15.630445Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-03T00:37:30.304423Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.12036","last_updated":"2024-06-30T15:12:10Z","snapshot_observed_at":"2026-08-16T13:42:05.389888Z","submitted_at":"2024-06-17T19:07:21Z","title":"MedCalc-Bench: Evaluating Large Language Models for Medical Calculations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12036","snapshot_observed_at":"2026-08-09T16:10:24.741545Z","title":"Medcalc- bench: Evaluating large language models for medical calculations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.01243","last_updated":"2025-02-03T11:04:51Z","snapshot_observed_at":"2026-08-13T15:01:44.141448Z","submitted_at":"2025-02-03T11:04:51Z","title":"OphthBench: A Comprehensive Benchmark for Evaluating Large Language Models in Chinese Ophthalmology","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-09T16:10:24.741545Z"},"links":{"cited_paper":"/paper/2406.12036","citing_paper":"/paper/2502.01243"},"observation_digest":"sha256:cd0506e868a0a549340b12c2b4db21c2234cf5f87cb0bfd156c078cd8edfad03","observation_id":"b76d961a-4776-4dd0-b14d-602468740e1c","resolution":{"observed_at":"2026-08-09T16:10:24.741545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12036","last_updated":"2024-06-30T15:12:10Z","snapshot_observed_at":"2026-08-16T13:42:05.389888Z","submitted_at":"2024-06-17T19:07:21Z","title":"MedCalc-Bench: Evaluating Large Language Models for Medical Calculations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12036","snapshot_observed_at":"2026-08-15T20:56:15.630445Z","title":"Sara Mahdavi, Nishant Subramani, Laichee Man, Karan Singhal, Alan Karthikesalingam, Vivek Natarajan, and Ryutaro Tanno","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.11613","last_updated":"2025-05-16T18:21:52Z","snapshot_observed_at":"2026-08-19T08:44:09.107347Z","submitted_at":"2025-05-16T18:21:52Z","title":"MedGUIDE: Benchmarking Clinical Decision-Making in Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T20:56:15.630445Z"},"links":{"cited_paper":"/paper/2406.12036","citing_paper":"/paper/2505.11613"},"observation_digest":"sha256:542bc61755aee54ae9a66cbe5b507ebb404c497434b686700123e2a6e6f9ebcf","observation_id":"b6141c47-7b77-4238-9954-ddf8308caf09","resolution":{"observed_at":"2026-08-15T20:56:15.630445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12036","last_updated":"2024-06-30T15:12:10Z","snapshot_observed_at":"2026-08-16T13:42:05.389888Z","submitted_at":"2024-06-17T19:07:21Z","title":"MedCalc-Bench: Evaluating Large Language Models for Medical Calculations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12036","snapshot_observed_at":"2026-08-15T16:37:52.838834Z","title":"Medcalc-bench: Evaluating large language models for medical calculations, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.03059","last_updated":"2026-07-26T23:59:38Z","snapshot_observed_at":"2026-08-15T17:21:39.654535Z","submitted_at":"2025-09-03T06:42:40Z","title":"Loong: Synthesize Long Chain-of-Thoughts at Scale through Verifiers","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T16:37:52.838834Z"},"links":{"cited_paper":"/paper/2406.12036","citing_paper":"/paper/2509.03059"},"observation_digest":"sha256:70b3a9090a85da5efe187a98f747960b602b2a56f583c21b46525f592a775e2b","observation_id":"5e2eb2f6-8d0e-47b9-ac02-615e2d83ecc7","resolution":{"observed_at":"2026-08-15T16:37:52.838834Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12036","last_updated":"2024-06-30T15:12:10Z","snapshot_observed_at":"2026-08-16T13:42:05.389888Z","submitted_at":"2024-06-17T19:07:21Z","title":"MedCalc-Bench: Evaluating Large Language Models for Medical Calculations","version":4},"cited_work":{"arxiv_id":"2406.12036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.12036","snapshot_observed_at":"2026-07-03T00:37:30.304423Z","title":null,"venue":null,"work_id":"59128cf9-9932-486d-8283-799f0819c963","year":2024},"citing_paper":{"arxiv_id":"2605.16679","last_updated":"2026-05-19T05:51:20Z","snapshot_observed_at":"2026-08-16T12:26:18.226673Z","submitted_at":"2026-05-15T22:34:31Z","title":"CHI-Bench: Can AI Agents Automate End-to-End, Long-Horizon, Policy-Rich Healthcare Workflows?","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-20T17:45:02.896703Z"},"links":{"cited_paper":"/paper/2406.12036","citing_paper":"/paper/2605.16679"},"observation_digest":"sha256:0026195a74a0925616903b524aa4e733fc71f83448130f69a62cd1a4527a21ee","observation_id":"a60b1f3f-f7b6-4e8a-8ef6-c75f54fdd677","resolution":{"observed_at":"2026-05-20T17:48:48.850449Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12036","last_updated":"2024-06-30T15:12:10Z","snapshot_observed_at":"2026-08-16T13:42:05.389888Z","submitted_at":"2024-06-17T19:07:21Z","title":"MedCalc-Bench: Evaluating Large Language Models for Medical Calculations","version":4},"cited_work":{"arxiv_id":"2406.12036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.12036","snapshot_observed_at":"2026-07-03T00:37:30.304423Z","title":null,"venue":null,"work_id":"59128cf9-9932-486d-8283-799f0819c963","year":2024},"citing_paper":{"arxiv_id":"2606.01145","last_updated":"2026-07-06T16:09:36Z","snapshot_observed_at":"2026-07-30T15:24:45.114962Z","submitted_at":"2026-05-31T10:27:18Z","title":"Reasoning4Sciences: Bridging Reasoning Language Models to All Scientific Branches","version":2},"reference_index":136,"source":"pdf_text","source_observed_at":"2026-06-28T17:35:01.285534Z"},"links":{"cited_paper":"/paper/2406.12036","citing_paper":"/paper/2606.01145"},"observation_digest":"sha256:108710963d63788e54e49f3c4659080925b8a6cfb2747510c75212c33445d2fb","observation_id":"d192d750-aa67-4c78-b149-3831ff2417b7","resolution":{"observed_at":"2026-07-01T20:56:14.342484Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12036","last_updated":"2024-06-30T15:12:10Z","snapshot_observed_at":"2026-08-16T13:42:05.389888Z","submitted_at":"2024-06-17T19:07:21Z","title":"MedCalc-Bench: Evaluating Large Language Models for Medical Calculations","version":4},"cited_work":{"arxiv_id":"2406.12036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.12036","snapshot_observed_at":"2026-07-03T00:37:30.304423Z","title":null,"venue":null,"work_id":"59128cf9-9932-486d-8283-799f0819c963","year":2024},"citing_paper":{"arxiv_id":"2606.01145","last_updated":"2026-07-06T16:09:36Z","snapshot_observed_at":"2026-07-30T15:24:45.114962Z","submitted_at":"2026-05-31T10:27:18Z","title":"Reasoning4Sciences: Bridging Reasoning Language Models to All Scientific Branches","version":3},"reference_index":148,"source":"pdf_text","source_observed_at":"2026-07-01T07:22:25.349398Z"},"links":{"cited_paper":"/paper/2406.12036","citing_paper":"/paper/2606.01145"},"observation_digest":"sha256:12abf33a2fab85c5ae5feec4362b7c7692579a765b5fb94fdb076473e8d6b732","observation_id":"69538a6b-6d28-4190-a67d-76ba7dea4148","resolution":{"observed_at":"2026-07-01T08:35:34.030925Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12036","last_updated":"2024-06-30T15:12:10Z","snapshot_observed_at":"2026-08-16T13:42:05.389888Z","submitted_at":"2024-06-17T19:07:21Z","title":"MedCalc-Bench: Evaluating Large Language Models for Medical Calculations","version":4},"cited_work":{"arxiv_id":"2406.12036","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.12036","snapshot_observed_at":"2026-07-03T00:37:30.304423Z","title":null,"venue":null,"work_id":"59128cf9-9932-486d-8283-799f0819c963","year":2024},"citing_paper":{"arxiv_id":"2606.10217","last_updated":"2026-06-08T22:15:20Z","snapshot_observed_at":"2026-08-13T11:17:41.299303Z","submitted_at":"2026-06-08T22:15:20Z","title":"Alignment Defends LLMs from Property Inference Attacks","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-27T17:05:19.853450Z"},"links":{"cited_paper":"/paper/2406.12036","citing_paper":"/paper/2606.10217"},"observation_digest":"sha256:0866248633071ebbb4628454df741a13bce9785c68fb8d7f35f048894babf810","observation_id":"46256d06-891e-4594-b086-fe623703490c","resolution":{"observed_at":"2026-07-03T00:37:30.305978Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2406.12036/citation-record","integrity":"/paper/2406.12036/integrity","json":"/paper/2406.12036/citation-record.json","paper":"/paper/2406.12036"},"outbound":[],"paper":{"arxiv_id":"2406.12036","last_updated":"2024-06-30T15:12:10Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-16T13:42:05.389888Z","submitted_at":"2024-06-17T19:07:21Z","title":"MedCalc-Bench: Evaluating Large Language Models for Medical Calculations"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 7 inbound Pith citation observations for arXiv:2406.12036."}