{"as_of":"2026-08-07T18:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:18b856898637c1ce6e64529402fd3157da542a6c827bcdf06d0d308842877d4a","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:19:33.245710Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.08349/citation-record","integrity":"/paper/2506.08349/integrity","json":"/paper/2506.08349/citation-record.json","paper":"/paper/2506.08349"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.08905","last_updated":"2024-12-12T03:37:41Z","snapshot_observed_at":"2026-08-05T04:04:21.846023Z","submitted_at":"2024-12-12T03:37:41Z","title":"Phi-4 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.08905","snapshot_observed_at":"2026-08-07T05:19:33.126829Z","title":"J., Javaheripi, M., Kauffmann, P., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.126829Z"},"links":{"cited_paper":"/paper/2412.08905","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:6171f1c23395418cc4ec9e07d1a78cdcb18dded62d909bbc027d808eb2ccc8cd","observation_id":"a78a2827-c586-419e-b5d6-48029857868f","resolution":{"observed_at":"2026-08-07T05:19:33.126829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.14219","last_updated":"2024-08-30T21:17:17Z","snapshot_observed_at":"2026-07-06T18:03:47.096406Z","submitted_at":"2024-04-22T14:32:33Z","title":"Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14219","snapshot_observed_at":"2026-08-07T05:19:33.130742Z","title":"A., Awan, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.130742Z"},"links":{"cited_paper":"/paper/2404.14219","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:f9eda08a5a87356f8857bf9cf0e589cd6e07ed5488b3431989f68dcce20aae0a","observation_id":"baaad06f-1a16-4614-83fb-429004cf21ea","resolution":{"observed_at":"2026-08-07T05:19:33.130742Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T05:19:33.134332Z","title":"L., Almeida, D., Altenschmidt, J., Altman, S., Anadkat, S., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.134332Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:65f5cfff5da985d7f7e41680304572f5272257cbe8e8f2620eee89ead75589b5","observation_id":"e6fd8e85-c75c-4a90-b8dd-048bf80acbe6","resolution":{"observed_at":"2026-08-07T05:19:33.134332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.591586Z","title":null,"venue":null,"work_id":"29fcbaae-7ab2-41ea-be9e-c0cca99bf113","year":2001},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.138904Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:9d9b08157e4908b1ec5787138342b0f761dc4f833fd1f202a0b12604236bd6ef","observation_id":"e1edc71c-ca9c-4b06-9973-ca92efbb74a8","resolution":{"observed_at":"2026-08-07T05:19:33.594125Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T05:19:33.142732Z","title":"M., Hauth, A., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.142732Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:f28ee50897f1abfa7351bbceef1e94c2c5752e5a2a95fda8c616520e5a374b65","observation_id":"73a37a47-5b85-4ec6-8b57-89151924ac1a","resolution":{"observed_at":"2026-08-07T05:19:33.142732Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16609","last_updated":"2023-09-28T17:07:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-28T17:07:49Z","title":"Qwen Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16609","snapshot_observed_at":"2026-08-07T05:19:33.146797Z","title":"Qwen technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.146797Z"},"links":{"cited_paper":"/paper/2309.16609","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:5046a399f95f95a71573fbbf7f47a695dc3bb60b912324076b7cdb9fb8f27d9f","observation_id":"b8962460-be4d-4715-a13a-e32a85b439d3","resolution":{"observed_at":"2026-08-07T05:19:33.146797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.584007Z","title":"Overview of the medical question answering task at trec 2017 liveqa","venue":null,"work_id":"a5d4bc53-1556-442d-a6e8-5e14df6705e8","year":2017},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.150105Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:066e0e994d903fd443da74b287377c44e206c039663f44c65ba6c4bac97a8181","observation_id":"a1e12a8d-ce13-4f17-b6a5-19d07d4e3f56","resolution":{"observed_at":"2026-08-07T05:19:33.586684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.576146Z","title":"S., Englehart, M","venue":null,"work_id":"b047de93-8229-4f3c-889f-2e456691a78e","year":1956},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.153164Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:e2fcbf88f57e5906367bffabd91fde867c2ce7ca01d7c282f40d3f8e99f9e26e","observation_id":"e4be78c0-33bf-47be-a4e8-95f3a2c3a249","resolution":{"observed_at":"2026-08-07T05:19:33.578962Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.568112Z","title":"The unified medical language system (umls): integrating biomedical terminology","venue":null,"work_id":"67060c98-ef44-4e80-821d-df15e906d0dd","year":2004},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.155904Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:24240b9c3470681ddffc58b154e20e0913d8e5cf5bfb24198b3bac6bfc406bf0","observation_id":"5d9070cc-4f18-475a-a428-33118c443882","resolution":{"observed_at":"2026-08-07T05:19:33.571091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.560033Z","title":null,"venue":null,"work_id":"bda91601-c76c-4220-9e2f-0759e180bfb4","year":2020},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.158633Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:9ac5595d858738a981bf130fb5ecc73b8c29fafbd13585a14c92935d7436d10f","observation_id":"cbc39d3a-86ce-4bad-803a-46ab91b44a48","resolution":{"observed_at":"2026-08-07T05:19:33.562957Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1609/aaai.v38i16.29723","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.551524Z","title":"Medbench: A large-scale chinese benchmark for evaluating medical large language models","venue":null,"work_id":"4d4bd7cf-d278-435a-95b1-d253bbcf4d1b","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.161403Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:2cdd6dc213e56fc706ae9d027ca9d2a692d63a033d55a025ee8501ecc812e37d","observation_id":"72be59a9-6e3a-4dc2-bef3-47e54e26ec34","resolution":{"observed_at":"2026-08-07T05:19:33.554631Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16079","last_updated":"2023-11-27T18:49:43Z","snapshot_observed_at":"2026-07-06T16:53:18.275859Z","submitted_at":"2023-11-27T18:49:43Z","title":"MEDITRON-70B: Scaling Medical Pretraining for Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16079","snapshot_observed_at":"2026-08-07T05:19:33.164270Z","title":"H., Romanou, A., Bonnet, A., Matoba, K., Salvi, F., Pagliardini, M., Fan, S., K \\\"o pf, A., Mohtashami, A., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.164270Z"},"links":{"cited_paper":"/paper/2311.16079","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:d8043fc02b9284489ae9500a39a8dced577cc21007afbaf429dc6b1d07defb92","observation_id":"7b449a13-136e-4b1c-8e37-a8137733ce75","resolution":{"observed_at":"2026-08-07T05:19:33.164270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.543857Z","title":"U., Pimentel, M","venue":null,"work_id":"1a2947c8-8c48-47b0-b1c0-4175ed616222","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.167785Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:8a7ef0ff5d3bbf0c0b44e0b5d63d0ed550b77212fde83c7c40058ebcf70d3578","observation_id":"8d05d94c-dc3b-458f-b289-ff7c5e008b1b","resolution":{"observed_at":"2026-08-07T05:19:33.546163Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06142","last_updated":"2024-08-12T13:37:31Z","snapshot_observed_at":"2026-08-04T21:49:27.462796Z","submitted_at":"2024-08-12T13:37:31Z","title":"Med42-v2: A Suite of Clinical LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.06142","snapshot_observed_at":"2026-08-07T05:19:33.170913Z","title":"K., Raha, T., Khan, S., and Pimentel, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.170913Z"},"links":{"cited_paper":"/paper/2408.06142","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:2de5e7cfb178d94771ebb1606c7a18c0e9bb7d396175a5198f2352183a122c2b","observation_id":"9a8cf196-9e57-404c-9580-351919d5c879","resolution":{"observed_at":"2026-08-07T05:19:33.170913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T05:19:33.173687Z","title":"The llama 3 herd of models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.173687Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:29feec62eeec2ee3b30f9331d22ab64f7be8ce5d1798e81bcdb819a0f9c36fc8","observation_id":"2f11382f-c86c-4fa6-a23b-6ceab1eb99e8","resolution":{"observed_at":"2026-08-07T05:19:33.173687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.536105Z","title":"Evaluation and mitigation of the limitations of large language models in clinical decision-making","venue":null,"work_id":"0164ed91-9cc3-41e7-95db-a839edba07cd","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.176259Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:af53f4247d256884c0a73ac34e8e3a535b5c77011348672475ea482c2667b7cc","observation_id":"105f22a7-a464-4273-91fb-2c2102d96403","resolution":{"observed_at":"2026-08-07T05:19:33.538983Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12186","last_updated":"2024-11-12T13:24:25Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-18T17:57:57Z","title":"Qwen2.5-Coder Technical Report","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12186","snapshot_observed_at":"2026-08-07T05:19:33.178782Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.178782Z"},"links":{"cited_paper":"/paper/2409.12186","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:5cd0e6501c8170bac50d9e995429fd0136da33df22aee51e9c03d9371f673633","observation_id":"0fcbfc62-bd5c-45bf-aff3-08c2a3a698a8","resolution":{"observed_at":"2026-08-07T05:19:33.178782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.528317Z","title":"What disease does this patient have? a large-scale open domain question answering dataset from medical exams","venue":null,"work_id":"f1d1b867-789d-4a34-b8be-1b49314ed09e","year":2021},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.181345Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:71d51294ac9169f795517b70d9e2b817d13c23f6bf6a30d495a0b7a7bfb94c30","observation_id":"f86ec334-4259-4823-86f7-b98d40e9386d","resolution":{"observed_at":"2026-08-07T05:19:33.531079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.184334Z","title":"P ub M ed QA : A dataset for biomedical research question answering","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.184334Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:a4086bab3c2b7d0bd995f0d305cee2a00a3571f7253fa027101eabce8c460277","observation_id":"4c0cd703-4887-4223-9258-4fd8c83a4fd0","resolution":{"observed_at":"2026-08-07T05:19:33.184334Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.519613Z","title":"E., Bulgarelli, L., Shen, L., Gayles, A., Shammout, A., Horng, S., Pollard, T","venue":null,"work_id":"390f1686-17ad-41fe-9244-2e163067676f","year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.187420Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:5daf39be09fda7a624e73f21dc17979a826feacf32ae4bd9c83f91fbed1a8777","observation_id":"eaca3cc6-1e9f-43ff-a53f-6ab39b6068f4","resolution":{"observed_at":"2026-08-07T05:19:33.522628Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.511621Z","title":"A., Roberts, A., et al","venue":null,"work_id":"d90f0897-9982-411a-8cbc-c53165989fd6","year":2021},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.190317Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:765cbdd9a9725ed10a1ca7544146d85a08d7e582e14efb898f7aef4de5053ce6","observation_id":"b9c83da7-d8bd-4a6c-b933-c0c64d238864","resolution":{"observed_at":"2026-08-07T05:19:33.514149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-07T05:19:33.193159Z","title":"Deepseek-v3 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.193159Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:87501c9273051122a045c322e840c2de4a335aa33a51468fbefc5bce91734432","observation_id":"c46d6e30-cdb6-46b1-82cf-70978be20cd9","resolution":{"observed_at":"2026-08-07T05:19:33.193159Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.08295","last_updated":"2024-04-16T12:52:47Z","snapshot_observed_at":"2026-08-03T03:29:01.959523Z","submitted_at":"2024-03-13T06:59:16Z","title":"Gemma: Open Models Based on Gemini Research and Technology","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.08295","snapshot_observed_at":"2026-08-07T05:19:33.196012Z","title":"S., Love, J., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.196012Z"},"links":{"cited_paper":"/paper/2403.08295","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:32450ffb0aba00b8144cdd0f1a77b2ef1c8d26ed118d5812957bb08293f5ea6e","observation_id":"97da048d-0f1c-41db-bd60-efe06806f59d","resolution":{"observed_at":"2026-08-07T05:19:33.196012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13375","last_updated":"2023-04-12T16:48:39Z","snapshot_observed_at":"2026-07-06T15:07:11.623462Z","submitted_at":"2023-03-20T16:18:38Z","title":"Capabilities of GPT-4 on Medical Challenge Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13375","snapshot_observed_at":"2026-08-07T05:19:33.198772Z","title":"M., Carignan, D., and Horvitz, E","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.198772Z"},"links":{"cited_paper":"/paper/2303.13375","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:cfa25b76794ed7e8be87da3a3d8f9e527c994703ff3083199ca905ae31066431","observation_id":"f6b9cd02-c8d5-4bcd-a317-cb386966799b","resolution":{"observed_at":"2026-08-07T05:19:33.198772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16452","last_updated":"2023-11-28T03:16:12Z","snapshot_observed_at":"2026-08-07T08:26:36.845011Z","submitted_at":"2023-11-28T03:16:12Z","title":"Can Generalist Foundation Models Outcompete Special-Purpose Tuning? Case Study in Medicine","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16452","snapshot_observed_at":"2026-08-07T05:19:33.202015Z","title":"T., Zhang, S., Carignan, D., Edgar, R., Fusi, N., King, N., Larson, J., Li, Y., Liu, W., et al","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.202015Z"},"links":{"cited_paper":"/paper/2311.16452","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:a5c8afa1c671c2120b6a60a19459c284efc22e89bb852d108f8ce69c842a35c8","observation_id":"3cd2eaad-b15f-42f2-bf48-c9c9468ef675","resolution":{"observed_at":"2026-08-07T05:19:33.202015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.503463Z","title":"Gpt-4o mini: advancing cost-efficient intelligence, 2024","venue":null,"work_id":"925e36b8-8df7-4829-b85e-7104cfe74ab4","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.205196Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:198d661c25bd6f383bdaead3fcc201c3b681a3ab540e4408bad5e8f1e5052a14","observation_id":"a5c9893b-15d8-47a0-bc03-e45d70f23d47","resolution":{"observed_at":"2026-08-07T05:19:33.506444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.495481Z","title":"L., Mishkin, P., Zhang, C., Agarwal, S., Slama, K., Ray, A., Schulman, J., Hilton, J., Kelton, F., Miller, L., Simens, M., Askell, A., Welinder, P., Christiano, P","venue":null,"work_id":"47268531-fb56-4f5b-93d9-1b54bad3507c","year":2022},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.207683Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:51dd4cb5a4d9695296fcc6ee86e0ab8603de9d4665ad8967d031a2f30d20c455","observation_id":"c3795670-7509-4275-a135-76acf6b41bc6","resolution":{"observed_at":"2026-08-07T05:19:33.498276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.486706Z","title":"Climedbench: A large-scale chinese benchmark for evaluating medical large language models in clinical scenarios","venue":null,"work_id":"24ae55f9-bd76-464b-b2fb-593ff01f5c1d","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.210803Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:98cf7650dad115ad182d62cccdbf82e0b80149fd750c4e0bea84c52ab506fc30","observation_id":"bfc94c8e-6edd-48f9-8d71-382c70598620","resolution":{"observed_at":"2026-08-07T05:19:33.489846Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.477729Z","title":"K., and Sankarasubbu, M","venue":null,"work_id":"402ac69e-bf47-4147-be5e-ceab03059216","year":2022},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.213449Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:faa40a2ab4b57ce34d0cd3b34c974876f51cb056484848609c803f6801b6712d","observation_id":"c8987b34-d0f1-4c58-9a8f-96e2a294843f","resolution":{"observed_at":"2026-08-07T05:19:33.480318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.469190Z","title":"Towards building multilingual language model for medicine","venue":null,"work_id":"6001bf9f-38c6-4217-9d5a-2ed40989eaba","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.216322Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:2da4ce41dfa9dfd0138958146ede9bd2daa5c6787298d2acc013a566e279690e","observation_id":"248fa337-d7e6-4676-bf79-384226bffc17","resolution":{"observed_at":"2026-08-07T05:19:33.472154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.460526Z","title":"S., Wei, J., Chung, H","venue":null,"work_id":"2c27ab76-5593-4157-ba19-e815594d5c37","year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.218853Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:801151c7555a82a0941d5aa773ca7187d96d38689212d822c51818cc120941dd","observation_id":"5e131aa7-9c55-476c-9375-e08872162d29","resolution":{"observed_at":"2026-08-07T05:19:33.463569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.09617","last_updated":"2023-05-16T17:11:29Z","snapshot_observed_at":"2026-08-03T08:52:05.725675Z","submitted_at":"2023-05-16T17:11:29Z","title":"Towards Expert-Level Medical Question Answering with Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.09617","snapshot_observed_at":"2026-08-07T05:19:33.221544Z","title":"Towards expert-level medical question answering with large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.221544Z"},"links":{"cited_paper":"/paper/2305.09617","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:022804e4987bc05f2b12447810a54485b20a4036fe1822f4b3d4412c01f58fa8","observation_id":"af6a1063-7661-448a-adea-d5ba1c302f63","resolution":{"observed_at":"2026-08-07T05:19:33.221544Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00118","last_updated":"2024-10-02T15:22:49Z","snapshot_observed_at":"2026-08-02T16:20:09.773989Z","submitted_at":"2024-07-31T19:13:07Z","title":"Gemma 2: Improving Open Language Models at a Practical Size","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00118","snapshot_observed_at":"2026-08-07T05:19:33.224344Z","title":"G., Hardin, C., Bhupatiraju, S., Hussenot, L., Mesnard, T., Shahriari, B., Ram \\'e , A., et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.224344Z"},"links":{"cited_paper":"/paper/2408.00118","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:336631be6ed1393cdc0ef56313700971942afc39f43399bace3785cb0c6e0e43","observation_id":"3ffb2cb6-3710-49b2-8cef-d42da69b3dad","resolution":{"observed_at":"2026-08-07T05:19:33.224344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12031","last_updated":"2023-08-17T17:19:02Z","snapshot_observed_at":"2026-08-06T16:28:29.854930Z","submitted_at":"2023-05-19T23:07:09Z","title":"Clinical Camel: An Open Expert-Level Medical Language Model with Dialogue-Based Knowledge Encoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12031","snapshot_observed_at":"2026-08-07T05:19:33.227231Z","title":"R., Ba, J., Krishnan, R","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.227231Z"},"links":{"cited_paper":"/paper/2305.12031","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:4a1894c98223d0b40d8a5b547622b1bdcbf85d366f157f7860efd94641817eb3","observation_id":"8336a65d-d5a4-4049-9261-69fb63164818","resolution":{"observed_at":"2026-08-07T05:19:33.227231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-07T05:19:33.231310Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.231310Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:202d5b7a7453ef707b8c9c3be41c6d2474fa9e1ee3ead10a690c17a66d462e4e","observation_id":"0acfdcce-ad1c-497e-8b42-1212f8ceea78","resolution":{"observed_at":"2026-08-07T05:19:33.231310Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T05:19:33.234201Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.234201Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:63e13622881da67113f37d8f595ceaeb12092f60d0fb18a7121eb6ec1fd91a7d","observation_id":"d8504776-e4c1-4978-96c2-9dc051e9a5e8","resolution":{"observed_at":"2026-08-07T05:19:33.234201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.451375Z","title":"CMB : A comprehensive medical benchmark in C hinese","venue":null,"work_id":"a3cf2d46-0a79-432f-af24-215e1740ef42","year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.236963Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:1d5d4f19cd537766bbfa65fea93727d578b72399d4398f206fdf31d8c86d7a46","observation_id":"17dcdb23-6cf0-47ba-9eb7-35b378b4663f","resolution":{"observed_at":"2026-08-07T05:19:33.454966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.441576Z","title":"C., Wu, J., and Liu, X","venue":null,"work_id":"b553ba61-c6ef-44bb-a253-711405f62ba8","year":2025},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.239860Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:8bf9f3ac14db094d848a3cee485bd8d560771bacd2967fac6d22492c20433315","observation_id":"ef377819-65cf-4f80-9436-19ae876ac2df","resolution":{"observed_at":"2026-08-07T05:19:33.445187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10671","last_updated":"2024-09-10T13:25:53Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-07-15T12:35:42Z","title":"Qwen2 Technical Report","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10671","snapshot_observed_at":"2026-08-07T05:19:33.242615Z","title":"Qwen2 technical report","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.242615Z"},"links":{"cited_paper":"/paper/2407.10671","citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:e49a02ad559d45675da79e5d8aa8ee09677cf3a45b123844116bd04f7a8d38df","observation_id":"02be86c3-a349-4375-a67d-3d21bc6e14cf","resolution":{"observed_at":"2026-08-07T05:19:33.242615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T05:19:33.245710Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T05:19:33.245710Z"},"links":{"citing_paper":"/paper/2506.08349"},"observation_digest":"sha256:e1b478d16697c7df04bbc9cc8b57edfac542ef7b45c0fd68cee22d1ec96b1df3","observation_id":"aa18151f-2968-4c77-9337-cd03dc8dcd71","resolution":{"observed_at":"2026-08-07T05:19:33.245710Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.08349","last_updated":"2025-06-10T02:07:33Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T05:10:54.764377Z","submitted_at":"2025-06-10T02:07:33Z","title":"Evaluating LLMs Across Multi-Cognitive Levels: From Medical Knowledge Mastery to Scenario-Based Problem Solving"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":23,"verified_exact":1,"verified_fuzzy":16},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2506.08349."}