{"as_of":"2026-08-13T10:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2936adf520994ac498522762d3ef419a6b17e39023f2e80168359d83069cf1a0","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-13T03:54:11.805387Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T04:18:05.046139Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-11T04:18:05.490656Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"cited_work":{"arxiv_id":"2607.09322","doi":null,"metadata_source":"pith","pith_arxiv_id":"2607.09322","snapshot_observed_at":"2026-08-11T04:18:05.490656Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","venue":"cs.AI","work_id":"c51bd84b-17ba-46d6-9723-ecfb96556bf7","year":2026},"citing_paper":{"arxiv_id":"2608.07796","last_updated":"2026-08-07T22:39:13Z","snapshot_observed_at":"2026-08-13T10:11:24.486619Z","submitted_at":"2026-08-07T22:39:13Z","title":"CliniCARE-Bench: Clinical Calibrated Audit of Medical Reasoning in EHR","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T04:18:05.046139Z"},"links":{"cited_paper":"/paper/2607.09322","citing_paper":"/paper/2608.07796"},"observation_digest":"sha256:033717744237ba719508cb53a81cb06d3025fa8cf5050530c661f97c28547195","observation_id":"6b953d02-81ef-47eb-b079-2255cc91aa7c","resolution":{"observed_at":"2026-08-11T04:18:05.497141Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2607.09322/citation-record","integrity":"/paper/2607.09322/integrity","json":"/paper/2607.09322/citation-record.json","paper":"/paper/2607.09322"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"arXiv preprint arXiv:2504.19413 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:052f3e3c1303386aa827be55e5370ba87a929f67b44e8d5921e498b5943d0c18","observation_id":"c2dc38c9-bdc1-4e7b-8961-534e6ede89a9","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:be171b9b838cfc0bb734f6bb2e862165710bf6fdc21c6e98649930f87e776bf7","observation_id":"28d8a0e3-5c05-4c54-9ba4-d1888d6d36a7","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:44c5b5cadad037980c685b2ee6dedcec935db93774dcd07bf15c197a3d042faa","observation_id":"9b1a0c8c-5a39-4331-aa4d-3e96d3ba3be8","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"Journal of medical Internet research 27, e84120 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:bfaac31ebea3fb140522e2d0523158c85e64a34887edeae46cd2d3a52d0e90e4","observation_id":"71f76bde-a72e-49e4-8407-3fab2c8dcce8","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06654","last_updated":"2024-08-06T21:48:58Z","snapshot_observed_at":"2026-08-10T09:20:57.804343Z","submitted_at":"2024-04-09T23:41:27Z","title":"RULER: What's the Real Context Size of Your Long-Context Language Models?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.06654","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2404.06654","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:9d74b278066c267b9d7bfc0c7245bba34bb07940025c43366058189a3c9f54c5","observation_id":"0bf90271-06f2-4de6-b820-f1e188789564","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"NEJM AI p","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:ff0c62d64d53b9e12af9eb7e6b7b64b50e9ead1245afe36bd3d79d0a8ebed9dd","observation_id":"f0f38a46-759d-4f96-8a0b-d64f15ac5029","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"PhysioNet (Oct 2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:f5a57b511071be83dce68f84faa9e889d9d1f40174b94c3b467d1cbec3602fb2","observation_id":"82dda204-1e89-4c0c-b6a7-cf6f494e0323","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.07040","last_updated":"2017-12-19T16:48:05Z","snapshot_observed_at":"2026-07-31T01:20:29.856066Z","submitted_at":"2017-12-19T16:48:05Z","title":"The NarrativeQA Reading Comprehension Challenge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.07040","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/1712.07040","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:4386f664a0a023885b9bec47f14b66cd9b982cae328039c9651b3b16b715d63a","observation_id":"9b5a0c37-3660-428a-87d4-636e8b001b28","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"Advances in Neural Information Processing Systems 35, 15589–15601 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:fd5820b79fe18d904469176a3e9fa17a9d480c9db3ee8e9d8fd8d7f8e244769d","observation_id":"7d106ae4-3c01-43c2-b565-11a61e6529d8","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17657","last_updated":"2025-06-16T06:25:31Z","snapshot_observed_at":"2026-08-12T22:16:56.885270Z","submitted_at":"2024-10-23T08:19:18Z","title":"ReflecTool: Towards Reflection-Aware Tool-Augmented Clinical Agents","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17657","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2410.17657","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:e5432fb7ae76dd5634345b0f411cc934a55571f87d28a70115e696b17e92c4f9","observation_id":"ccbd14d6-5ced-4988-890d-f5e5a86af649","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03172","last_updated":"2023-11-20T23:09:34Z","snapshot_observed_at":"2026-07-06T15:51:12.179086Z","submitted_at":"2023-07-06T17:54:11Z","title":"Lost in the Middle: How Language Models Use Long Contexts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03172","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"Xu et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2307.03172","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:2c0d32b47e4a9bcc605c4fea9724c854f8928467b80dd1ea8a67091f75529d87","observation_id":"12c92b9d-138e-4f9e-989f-b1932c4b5d59","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17753","last_updated":"2024-02-27T18:42:31Z","snapshot_observed_at":"2026-08-13T02:36:36.245972Z","submitted_at":"2024-02-27T18:42:31Z","title":"Evaluating Very Long-Term Conversational Memory of LLM Agents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17753","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"arXiv preprint arXiv:2402.17753 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2402.17753","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:02a7b2d571b039856866d046b1bdc1d60545efd6fd6fc6ef097732af9d8e61bf","observation_id":"ab4aa5d5-7d36-45c2-98df-64383f0f16bf","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"https://developers.openai.com/api/docs/models/gpt- 5-mini (2026), accessed 22 Feb 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:78a83c1a166d9fbf856b018a9517e758bfaff9b6205bd3278c1b1579a323f609","observation_id":"faaa1bf4-56e8-4a62-a837-9eafcb49ecec","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"https://developers.openai.com/api/docs/models/text- embedding-3-small (2026), accessed 22 Feb 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:3a3e3b864cdd5a81d4198c26b59b14da58714e4a2b5b7d841222b4336aa4db4c","observation_id":"70e9150b-08d4-491c-b4dd-941c922a4ddb","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:4d52af25e38d2bfa856bd491dbf8a1edcf4d4c4bd78f49ae5ac1671038170547","observation_id":"d8dcca31-e913-427f-ab89-399fad0e1c7f","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"https://qwen.ai/blog?id=qwen3 (2024), accessed: 22 Feb 2026","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:4eae4b9cc050099da2ebf4527cc4c3e244cd0950c029ce42d8c3f30ee8f09927","observation_id":"936a5c28-b295-4068-b876-b2adf1a71291","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.07960","last_updated":"2025-05-25T02:19:37Z","snapshot_observed_at":"2026-07-30T08:34:47.046912Z","submitted_at":"2024-05-13T17:38:53Z","title":"AgentClinic: a multimodal agent benchmark to evaluate AI in simulated clinical environments","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.07960","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2405.07960","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:84518c6647cc05293237a3c033e05dfb90aae28dff1f055184eaf95a654378fd","observation_id":"dc345ca6-188b-488c-81de-58a74508ceb7","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:4f765ffeedfbb8de0e3437ae411c827e58c6a824536914cc876b5dba99cf4ba7","observation_id":"570233fe-6d1d-48d5-94fb-843e3950cecf","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.10813","last_updated":"2025-03-04T22:19:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-14T17:59:44Z","title":"LongMemEval: Benchmarking Chat Assistants on Long-Term Interactive Memory","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.10813","snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"https://arxiv.org/abs/2410.10813 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"cited_paper":"/paper/2410.10813","citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:69fa4fc53e3df19ffd84a23f364ac390b14c41862a66816e29526edbac986f34","observation_id":"feaafc4f-d5aa-46e7-a84b-b8207ae98d3f","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-13T03:54:11.805387Z","title":"In: Conference on Empirical Methods in Natural Language Processing (EMNLP) (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-13T03:54:11.805387Z"},"links":{"citing_paper":"/paper/2607.09322"},"observation_digest":"sha256:40b030e50e95c4204ec59e3ce9e2378dbdbcaf6ab4cfc58d19b99bc095ca5f1a","observation_id":"0777cc87-ae87-4d29-bf74-8ca3aa481b63","resolution":{"observed_at":"2026-07-13T03:54:11.805387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.09322","last_updated":"2026-07-10T12:04:31Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-12T23:45:41.156127Z","submitted_at":"2026-07-10T12:04:31Z","title":"LongMedBench: Benchmarking Medical Agents for Long-Horizon Clinical Decision-Making"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 1 inbound Pith citation observation for arXiv:2607.09322."}