{"as_of":"2026-08-08T03:39:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b10e3c87dc25c0f44bec8cac8e8846ad111323f02273913c5836304f9bbb00c6","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T13:15:59.973239Z","state":"measured"},{"denominator":29,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":29,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.22240/citation-record","integrity":"/paper/2505.22240/integrity","json":"/paper/2505.22240/citation-record.json","paper":"/paper/2505.22240"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:16:03.174146Z","title":null,"venue":null,"work_id":"c2cc37c8-c6e7-4c00-92f4-43eaacc70d16","year":2023},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:57.735821Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:88635fd1d978e8fd6350715bf18e7763c594b90a76c3dde7a90a898b45a4f779","observation_id":"413835d9-2469-4448-bb32-561452f25363","resolution":{"observed_at":"2026-08-07T13:16:03.264085Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18925","last_updated":"2024-12-25T15:12:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-25T15:12:34Z","title":"HuatuoGPT-o1, Towards Medical Complex Reasoning with LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18925","snapshot_observed_at":"2026-08-07T13:15:57.786652Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:57.786652Z"},"links":{"cited_paper":"/paper/2412.18925","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:20606fb61e00c74531e2c016ecb3653762f9b8292311c0cff163e1c8bf6338ac","observation_id":"4308ac0f-d76c-4479-bcf3-57161113560b","resolution":{"observed_at":"2026-08-07T13:15:57.786652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T13:15:57.857398Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:57.857398Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:0efcc8e449468ff7f6ad2b3c49f6accca101c348455dfb81fa578f781f9c856b","observation_id":"d615530a-2ecf-469c-8e04-4cb62f5a1680","resolution":{"observed_at":"2026-08-07T13:15:57.857398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:16:02.901446Z","title":null,"venue":null,"work_id":"ceb63b65-a6a8-4f2e-b5c9-f42d0cc819ce","year":2018},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:57.912994Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:7f191d1396052262ca8a84cfa1af053643f0d3e6fca7000a2c411ecce697c31d","observation_id":"86a1a3a2-c62e-4cf7-8320-2b47bf37afc4","resolution":{"observed_at":"2026-08-07T13:16:03.044954Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T13:15:57.967016Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:57.967016Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:f6f3cbfaa43fc29b6a47d8456f53c2c5941112b3ea6808426ac64b0417fb6311","observation_id":"9b267433-4c1a-4744-adb7-c010730b2615","resolution":{"observed_at":"2026-08-07T13:15:57.967016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:16:02.633919Z","title":null,"venue":null,"work_id":"98d47a9e-c323-4210-b9ee-92e90c135588","year":2017},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.022954Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:7016334080cf74978c588c7dd173998badc72ba5912d777920000c00c36995d4","observation_id":"6a9709cf-f8c2-4439-b520-9fabbbd5ee89","resolution":{"observed_at":"2026-08-07T13:16:02.700467Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10403","last_updated":"2023-05-26T17:59:33Z","snapshot_observed_at":"2026-08-06T19:23:30.079167Z","submitted_at":"2022-12-20T16:29:03Z","title":"Towards Reasoning in Large Language Models: A Survey","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10403","snapshot_observed_at":"2026-08-07T13:15:58.084148Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.084148Z"},"links":{"cited_paper":"/paper/2212.10403","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:22a6d743cc4972ad6d3ceba5e6e15a1ac2ccddcfbed7eb8e4f59d8c82164af3e","observation_id":"a350b17b-1df6-4784-88e5-39f4af3d0900","resolution":{"observed_at":"2026-08-07T13:15:58.084148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T13:15:58.142435Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.142435Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:770ca52b1ae165167daddcdc7d15c605c88d6697e2edf4570285664ab831f00c","observation_id":"cdbfb5cc-8941-4471-8b47-6413bf499c21","resolution":{"observed_at":"2026-08-07T13:15:58.142435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:15:58.206348Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.206348Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:e1aee68024ebc816b55a5519b07f7a1bb4ef734b939ed334d805d23aa7b410a4","observation_id":"538652d7-46b5-4071-9114-21c567094419","resolution":{"observed_at":"2026-08-07T13:15:58.206348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.06331","last_updated":"2024-07-03T10:13:56Z","snapshot_observed_at":"2026-08-08T03:10:08.397194Z","submitted_at":"2024-06-10T14:47:04Z","title":"MedExQA: Medical Question Answering Benchmark with Multiple Explanations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.06331","snapshot_observed_at":"2026-08-07T13:15:58.263719Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.263719Z"},"links":{"cited_paper":"/paper/2406.06331","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:5cd3eff5b133567f7bb2dce7f2f9b54d66aca04804a1e5f78cf98eaa4597d49a","observation_id":"9f3f7833-6bc2-49ff-96b8-04d12c84cac7","resolution":{"observed_at":"2026-08-07T13:15:58.263719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.02907","last_updated":"2017-02-22T09:55:36Z","snapshot_observed_at":"2026-07-06T05:10:16.862707Z","submitted_at":"2016-09-09T19:48:41Z","title":"Semi-Supervised Classification with Graph Convolutional Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.02907","snapshot_observed_at":"2026-08-07T13:15:58.323160Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.323160Z"},"links":{"cited_paper":"/paper/1609.02907","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:f2214c3d17b265f3c4ba474d688060a73010c58ead39da2aa177a901a488caec","observation_id":"325302aa-4ae8-4ee3-b7a7-f49d9e856a02","resolution":{"observed_at":"2026-08-07T13:15:58.323160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:15:58.403466Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.403466Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:37ac30669a246f1313b827dcf11dfa2584609f6f6ea8dc8b6fd54217e686a1cb","observation_id":"8765a617-a370-4ede-9833-6404997aec11","resolution":{"observed_at":"2026-08-07T13:15:58.403466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:16:02.314086Z","title":null,"venue":null,"work_id":"93841a8c-46df-4220-833a-f595c3ebde09","year":2019},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.473922Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:71d0c820499fa09d2ec384487d8aab4fe854980da32035637379d1f332e4c3f9","observation_id":"ff60aa2c-2a78-497d-a964-80eff6eba7cc","resolution":{"observed_at":"2026-08-07T13:16:02.462001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:16:02.031634Z","title":null,"venue":null,"work_id":"f870f476-787c-4bf9-9ecc-a2223fb9459a","year":2025},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.539028Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:3f794035269ef6f0617f671893fe7284111157a61690e33348431df0e9f22914","observation_id":"4bc5df1f-458b-4b72-9b32-85848ae8e15c","resolution":{"observed_at":"2026-08-07T13:16:02.179570Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04009","last_updated":"2023-06-06T20:45:18Z","snapshot_observed_at":"2026-07-06T15:39:26.695526Z","submitted_at":"2023-06-06T20:45:18Z","title":"Triggering Multi-Hop Reasoning for Question Answering in Language Models using Soft Prompts and Random Walks","version":1},"cited_work":{"arxiv_id":"2306.04009","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.04009","snapshot_observed_at":"2026-08-07T13:16:00.880304Z","title":"Triggering Multi-Hop Reasoning for Question Answering in Language Models using Soft Prompts and Random Walks","venue":"cs.CL","work_id":"c3449b12-d411-4d0b-b6a5-654b9a7e657a","year":2023},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.598739Z"},"links":{"cited_paper":"/paper/2306.04009","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:b275a66d3e39e23424c2f7de0813f03e66137e9c48bc6d5a497f353cb1b8fad9","observation_id":"13045151-5e7f-4384-a55e-432ace701bc7","resolution":{"observed_at":"2026-08-07T13:16:00.945995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:16:01.816451Z","title":null,"venue":null,"work_id":"904fb851-60ef-4af0-9269-77629e00f601","year":2025},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.654749Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:f1263eef04f6df17a43180870824a67b2c8155f1887d61f42a647198ac68f000","observation_id":"1bbb2c26-5063-4c48-bea4-d9100f769005","resolution":{"observed_at":"2026-08-07T13:16:01.877909Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:16:01.633842Z","title":null,"venue":null,"work_id":"0faeb88c-bc53-4c84-a290-23c161de3d12","year":2022},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.736888Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:8b45605afb2d62c959234cb0ca2fe50e00f4ef410fda533ef5dfeebfdcb5cd45","observation_id":"55c0162c-e65e-4e0f-8061-310d6626c209","resolution":{"observed_at":"2026-08-07T13:16:01.714081Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:15:58.833029Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.833029Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:667f1fb1039678f8b2f37f306e2cdbe0cda812775bf505682f8d060b794efc59","observation_id":"42d38798-79eb-49a2-af1c-c7597cddb234","resolution":{"observed_at":"2026-08-07T13:15:58.833029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.05351","last_updated":"2022-11-10T05:43:57Z","snapshot_observed_at":"2026-07-06T14:16:32.814891Z","submitted_at":"2022-11-10T05:43:57Z","title":"Biomedical Multi-hop Question Answering Using Knowledge Graph Embeddings and Language Models","version":1},"cited_work":{"arxiv_id":"2211.05351","doi":null,"metadata_source":"pith","pith_arxiv_id":"2211.05351","snapshot_observed_at":"2026-08-07T13:16:00.531078Z","title":"Biomedical Multi-hop Question Answering Using Knowledge Graph Embeddings and Language Models","venue":"cs.AI","work_id":"19233aff-e970-44c3-8e50-a0ff97c37632","year":2022},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:58.924514Z"},"links":{"cited_paper":"/paper/2211.05351","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:19440a9714637f5035da4782fefc3e57fc8571c360bc815d09fcd8c4ffe2b134","observation_id":"3b9b644c-17aa-40ae-9658-202b98cf1388","resolution":{"observed_at":"2026-08-07T13:16:00.632457Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16075","last_updated":"2023-11-27T18:46:17Z","snapshot_observed_at":"2026-07-06T16:53:18.275859Z","submitted_at":"2023-11-27T18:46:17Z","title":"BioLORD-2023: Semantic Textual Representations Fusing LLM and Clinical Knowledge Graph Insights","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16075","snapshot_observed_at":"2026-08-07T13:15:59.006447Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:59.006447Z"},"links":{"cited_paper":"/paper/2311.16075","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:41844128b9a8e1446af08c13d700ad7f3314bfdf09cc0cc37e8afc86d430b07d","observation_id":"0c8feca9-31b6-4262-bab1-fa7f452dbb80","resolution":{"observed_at":"2026-08-07T13:15:59.006447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.13397","last_updated":"2024-06-19T09:38:59Z","snapshot_observed_at":"2026-08-04T04:49:49.358134Z","submitted_at":"2024-06-19T09:38:59Z","title":"MoreHopQA: More Than Multi-hop Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.13397","snapshot_observed_at":"2026-08-07T13:15:59.120657Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:59.120657Z"},"links":{"cited_paper":"/paper/2406.13397","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:ebcf45be39a54c236befa95ee29dcec82d766e939a6613f93199daa966f1ee6d","observation_id":"615c8f99-c351-442e-8c9b-48584c85471c","resolution":{"observed_at":"2026-08-07T13:15:59.120657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:16:01.452926Z","title":null,"venue":null,"work_id":"fc363967-e277-4872-8dc8-2e0a6db5ee8f","year":2017},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:59.229986Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:8d41a4c3b03ed3a34cda334fca21426f03ec53f3bde2d80cd4f1f55e51267e5d","observation_id":"bb1dc856-ebcb-4e14-8f51-0986043f19b1","resolution":{"observed_at":"2026-08-07T13:16:01.540849Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.04660","last_updated":"2025-03-03T18:23:47Z","snapshot_observed_at":"2026-08-07T20:00:28.481558Z","submitted_at":"2024-10-07T00:17:37Z","title":"KGARevion: An AI Agent for Knowledge-Intensive Biomedical QA","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.04660","snapshot_observed_at":"2026-08-07T13:15:59.317364Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:59.317364Z"},"links":{"cited_paper":"/paper/2410.04660","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:0a4e0fd0868fca70f138010d3c0b209d8553f6941b9aae6ba1db2d07023b34de","observation_id":"2642aa54-b72e-411c-87ac-a7e5c61120bd","resolution":{"observed_at":"2026-08-07T13:15:59.317364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2109.07154","last_updated":"2021-09-15T08:34:56Z","snapshot_observed_at":"2026-07-06T11:47:53.895893Z","submitted_at":"2021-09-15T08:34:56Z","title":"Can Language Models be Biomedical Knowledge Bases?","version":1},"cited_work":{"arxiv_id":"2109.07154","doi":null,"metadata_source":"pith","pith_arxiv_id":"2109.07154","snapshot_observed_at":"2026-08-07T13:16:00.266580Z","title":"Can Language Models be Biomedical Knowledge Bases?","venue":"cs.CL","work_id":"41c91ba0-ab11-46d0-bf47-56cd14fb74ac","year":2021},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:59.416826Z"},"links":{"cited_paper":"/paper/2109.07154","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:16e2ff30bea41f1539367fdfc0d8bac7cf15d983584b763c6c355797051323e0","observation_id":"55a90d3a-43ec-4099-b4b1-8d710e5fc914","resolution":{"observed_at":"2026-08-07T13:16:00.328476Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.03771","last_updated":"2020-07-14T03:42:34Z","snapshot_observed_at":"2026-07-06T08:27:58.343233Z","submitted_at":"2019-10-09T03:23:22Z","title":"HuggingFace's Transformers: State-of-the-art Natural Language Processing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.03771","snapshot_observed_at":"2026-08-07T13:15:59.534750Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:59.534750Z"},"links":{"cited_paper":"/paper/1910.03771","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:796e1357c38b3e72f0f5c949d0ba7bfc50e40712665507e6c20ccd46d5a81b82","observation_id":"c20c346b-cd10-400e-94c7-ba1dd2d1caae","resolution":{"observed_at":"2026-08-07T13:15:59.534750Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16837","last_updated":"2025-05-31T11:20:49Z","snapshot_observed_at":"2026-08-07T23:54:17.854354Z","submitted_at":"2024-02-26T18:57:54Z","title":"Do Large Language Models Latently Perform Multi-Hop Reasoning?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16837","snapshot_observed_at":"2026-08-07T13:15:59.661139Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:59.661139Z"},"links":{"cited_paper":"/paper/2402.16837","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:628babeb9099efe7f4b2a777281e61170dea07e735140ebdc501f85c78bb5b1e","observation_id":"b05d59e1-3e0a-4dd5-b1a4-5f59b28d1b82","resolution":{"observed_at":"2026-08-07T13:15:59.661139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.03949","last_updated":"2024-10-29T07:17:08Z","snapshot_observed_at":"2026-07-06T18:26:23.994796Z","submitted_at":"2024-06-06T10:50:26Z","title":"UltraMedical: Building Specialized Generalists in Biomedicine","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.03949","snapshot_observed_at":"2026-08-07T13:15:59.769600Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:59.769600Z"},"links":{"cited_paper":"/paper/2406.03949","citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:3573ac52791f6e6340f6d5e40d550e6e50ceed9479cc2e4abd7f46458964c110","observation_id":"4fe79720-6bb4-419b-9202-339eb4b2fc23","resolution":{"observed_at":"2026-08-07T13:15:59.769600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:15:59.896949Z","title":"URL: \" 'urlintro :=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:59.896949Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:ff1b4763ec14ddff72d963b10f425103435379f585a15ea71a0f4fca0b68508e","observation_id":"47ed465f-f50f-4c62-b823-781d628174b1","resolution":{"observed_at":"2026-08-07T13:15:59.896949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T13:15:59.973239Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T13:15:59.973239Z"},"links":{"citing_paper":"/paper/2505.22240"},"observation_digest":"sha256:208e41cacb9e13ff4e82c9c09709eac94d6734199f0f31b8001cdcbfb7f4c1bc","observation_id":"1c196127-fb9d-4ab3-8290-5f1e06d69350","resolution":{"observed_at":"2026-08-07T13:15:59.973239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.22240","last_updated":"2025-06-09T00:31:09Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T13:09:46.299438Z","submitted_at":"2025-05-28T11:19:01Z","title":"BioHopR: A Benchmark for Multi-Hop, Multi-Answer Reasoning in Biomedical Domain"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":3,"verified_fuzzy":0},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 0 inbound Pith citation observations for arXiv:2505.22240."}