{"as_of":"2026-08-06T02:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:18cb4815dd8b318d22b2ebae7552f265f23dcaf01ed589310f6a4409a3167cc0","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-26T08:22:21.299532Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T13:50:41.581622Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.23301","snapshot_observed_at":"2026-07-14T06:30:16.612345Z","title":"Ehr-complex: Benchmarking medical agents for complex clinical reasoning.arXiv preprint arXiv:2606.23301, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.11175","last_updated":"2026-07-13T07:16:50Z","snapshot_observed_at":"2026-07-16T23:19:14.481825Z","submitted_at":"2026-07-13T07:16:50Z","title":"The Path to Self-Evolving Clinical Systems: Scaling Medical Agents from Assistance to Autonomy","version":1},"reference_index":198,"source":"pdf_text","source_observed_at":"2026-07-14T06:30:16.612345Z"},"links":{"cited_paper":"/paper/2606.23301","citing_paper":"/paper/2607.11175"},"observation_digest":"sha256:cc67b4f0f21e17a3954a989730d3e87d8208b7908d8ac2e9512e51cdf273ad66","observation_id":"872e3f4c-8859-4e31-988d-c964b880658b","resolution":{"observed_at":"2026-07-14T06:30:16.612345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"cited_work":{"arxiv_id":"2606.23301","doi":"10.48550/arxiv.2606.23301","metadata_source":"pith","pith_arxiv_id":"2606.23301","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","venue":"cs.AI","work_id":"2baa44d1-2652-4432-9bd9-e71b161249f6","year":2026},"citing_paper":{"arxiv_id":"2607.18999","last_updated":"2026-07-26T15:35:54Z","snapshot_observed_at":"2026-08-01T13:50:38.848506Z","submitted_at":"2026-07-21T11:32:41Z","title":"MedDDC-Eval: Diagnosis-Decoupled Evaluation of Multi-Turn Medical Consultation Agents","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T13:50:41.581622Z"},"links":{"cited_paper":"/paper/2606.23301","citing_paper":"/paper/2607.18999"},"observation_digest":"sha256:6222dd2a464ac51bdbb198d7da6877fda4e0cbd0c1823efed58ff85d6e7f7d15","observation_id":"3dc521d6-9f94-4194-843f-a85d6f9dca49","resolution":{"observed_at":"2026-08-01T13:53:33.332394Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2606.23301/citation-record","integrity":"/paper/2606.23301/integrity","json":"/paper/2606.23301/citation-record.json","paper":"/paper/2606.23301"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:07e3453327cffeb12ff75d0068d417ecaa505420cff051f71e800116ff370dca","observation_id":"57628b3c-0af6-43a5-b90b-3b29d17a342b","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:5a320c59bce7aa80b8950008e9d348a2ed86790459bfc948df5e5dbe73c92bdb","observation_id":"9f11cd05-e565-4ced-9900-a5718a5c6e84","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:d1a18a99cd92769dcb3a7e5373ae3fe92e630887c9a5121526a3372431bf9a1e","observation_id":"e4ee7227-7a61-43bd-a5f8-86772f20b478","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:ad4f82d1d7e4c8000dc07f9f75aa696242bd82fc0553d463b49ce1d83a779d5b","observation_id":"b1e41189-1393-48fb-9fe8-79e365536ffb","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:e3d94aef89dcbd35dd772365de60fd390248ff54e56888b3ed96c294cd360b2e","observation_id":"abc3ceb2-a091-4cf7-9ece-b53bf22489ca","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:fa84c7d64b7f380da943dcac5c0fc72acb62cc6be65aaf64f852ddcd32536a3a","observation_id":"a21020a8-9eff-48b9-9cde-ad0ec25df9f8","resolution":{"observed_at":"2026-07-04T10:59:45.710582Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:6b08437d0940119ff77cfd9206ff4d425edf096a5fa1f39e33c1fd8f5b3b0525","observation_id":"9a07ea40-ce49-4792-b645-5d9698f5034c","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:7bf5703fc36d75a3b0798ffe021338013b34bf7fb0807a9e55fbb4603442f037","observation_id":"a7fc6bd6-fa47-420f-8757-b1b21e360330","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:4481879c714510ac0ec21793f79f5ea7bd2e6d00a3173d6d9072459ee32c42c4","observation_id":"e6e20a27-dff5-4e6c-8712-2bef8cb3b740","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:072ac7108705c3327bcf6eee55800f610de6826ef1a0ec8e28ae03e81308119d","observation_id":"4d66042d-328c-4c02-b8cc-4bffb7a651a9","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.19319","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T10:59:45.712211Z","title":"Fhir-agentbench: Benchmarking llm agents for realistic interoperable ehr question answering","venue":null,"work_id":"a8e8d4c4-75eb-43af-a4fb-7b420cabb12c","year":2025},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:63756a0e739d10889ab2d58bc05c34751de0035b1f90c7f346590efb34422c26","observation_id":"0600d2ef-4b23-495e-98fc-59b9faec3cf1","resolution":{"observed_at":"2026-07-04T10:59:45.713736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:fac823cf27b23cfde8adf63295d305922da365c2c6517fa2af6c85c0dfb99cf8","observation_id":"402d1d18-6c1f-49fa-b858-f5a3952d3547","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":"2412.19437","doi":"10.1016/j.neucom.2023.127063.url:https://www.sciencedirect","metadata_source":"pith","pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"DeepSeek-V3 Technical Report","venue":"cs.CL","work_id":"57d2791d-2219-4c31-a077-afc04b12a75c","year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:f03c60b29eb1185249785ae8d86693711c168bae6c93da701138fbee1d1ee232","observation_id":"a21cbcf9-4ed4-4e18-9c48-07488c3626f4","resolution":{"observed_at":"2026-07-04T10:59:45.706716Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:8bb848b95a8c36142cc33adc211d6afe620b32b2b31f0e0851d8fba0bb76233a","observation_id":"28a0922b-f2e6-43aa-9f56-76f868fada31","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:2ec213c185c20e7d98371cd971137be617be35d90a6b3ae41b01e34a9daff0a4","observation_id":"b87366d6-a87f-448f-ad54-23a06ae229eb","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:8fdb7ada16dc58fd3dde4d0335289463b0a6a887c3a3ec2a2ec438fa639f4f98","observation_id":"205d502d-0245-43ca-bd16-a9681e766de2","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:973fa6a9d43c6ada7236eca878c788d7f7637e8d75107c958507a0d8f0d0e94a","observation_id":"604f0058-a23e-468b-ad77-69d3d838b66c","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:5de0cc4a74f04dbada919d5b10c0c7b38171ee93af0b904305443b2fd6a08a53","observation_id":"a6925a07-634d-48f8-8e24-0ca72e39a91c","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:f86f47a3922bf21e26399426adf7294155b5005247ff9528776e57cce5404080","observation_id":"017b6d96-a4b1-49a3-b13e-0fe0d220f6dc","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:7bdb574dbf2931c5a024b3caa9202e00270cfa1f37e594915a48eb86bb0afaf0","observation_id":"91f4438c-1dbc-4693-b807-23be2251587a","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:5dd8914573585844fc90e04aaba0be70b4c77b2b3b69eb91a4c19fac1078876d","observation_id":"b78f6d85-e491-4abd-a5a4-116253856be2","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.02276","last_updated":"2026-02-02T16:17:38Z","snapshot_observed_at":"2026-07-06T22:44:09.804048Z","submitted_at":"2026-02-02T16:17:38Z","title":"Kimi K2.5: Visual Agentic Intelligence","version":1},"cited_work":{"arxiv_id":"2602.02276","doi":"10.48550/arxiv.2602.02276","metadata_source":"pith","pith_arxiv_id":"2602.02276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Kimi K2.5: Visual Agentic Intelligence","venue":"cs.CL","work_id":"d690be8f-5d53-49b0-b1e7-79668eb8fcdb","year":2026},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"cited_paper":"/paper/2602.02276","citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:e40aad8153221079cae6f11dab8ddd667e31b02c90810f6e2ab996f52ee3d3c9","observation_id":"3887b57e-e2b4-401c-998c-efb3ed4b9400","resolution":{"observed_at":"2026-07-04T10:59:45.719324Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:f09591f1f1f73b0e050ff74b70e8629f685a825bc99ac5f7f833dd3ab090e763","observation_id":"44df2738-0950-413e-ae6c-976d630d376b","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:153890e04a4574e758f0cacf761545fd2cb62870454e10b5c66db37e85d0a65b","observation_id":"a574c849-924b-4e6a-8747-1c7cd0f6e2b5","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12045","last_updated":"2024-06-17T19:33:08Z","snapshot_observed_at":"2026-08-02T22:19:29.043854Z","submitted_at":"2024-06-17T19:33:08Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","version":1},"cited_work":{"arxiv_id":"2406.12045","doi":"10.48550/arxiv.2406.12045","metadata_source":"pith","pith_arxiv_id":"2406.12045","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\tau$-bench: A Benchmark for Tool-Agent-User Interaction in Real-World Domains","venue":"cs.AI","work_id":"6a8d8dc4-0cc0-4052-8109-abbcdcd4a962","year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"cited_paper":"/paper/2406.12045","citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:700f0e815f870ed84d9af4ebb57d130cac65ae8840b574a70f67db85cb71e4f6","observation_id":"e1e5ca15-84e7-4631-99d3-239780ee0b4e","resolution":{"observed_at":"2026-07-04T10:59:45.716469Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-07-14T18:20:21.86453+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T18:20:21.86453+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:cb7be9157bcf70d785abae931ed3d747cfb2887a0e6d9ef5c7bc8d9001f81a3c","observation_id":"cd98217c-ccd0-4c6e-9091-111b701647d8","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-26T08:22:21.299532Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-26T08:22:21.299532Z"},"links":{"citing_paper":"/paper/2606.23301"},"observation_digest":"sha256:62031388efc477e3d6b1b3821254be6d5bd6338ba917be2e0ee7cf6ff385d59b","observation_id":"5b4001c7-4f5c-4a11-82fb-897208026f7b","resolution":{"observed_at":"2026-06-26T08:22:21.299532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.23301","last_updated":"2026-06-22T13:14:21Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-07-06T23:58:02.040198Z","submitted_at":"2026-06-22T13:14:21Z","title":"EHR-Complex: Benchmarking Medical Agents for Complex Clinical Reasoning"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":22,"verified_exact":5,"verified_fuzzy":0},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 2 inbound Pith citation observations for arXiv:2606.23301."}