{"as_of":"2026-08-08T06:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1838b0017d59fd5210790205bd0e690875c50c2b8afa96232bd0ebb2308c328d","coverage":[{"denominator":33,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:02:08.628751Z","state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.16648/citation-record","integrity":"/paper/2505.16648/integrity","json":"/paper/2505.16648/citation-record.json","paper":"/paper/2505.16648"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.14779","last_updated":"2024-04-23T06:36:21Z","snapshot_observed_at":"2026-07-06T18:04:08.777507Z","submitted_at":"2024-04-23T06:36:21Z","title":"Med42 -- Evaluating Fine-Tuning Strategies for Medical LLMs: Full-Parameter vs. Parameter-Efficient Approaches","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.14779","snapshot_observed_at":"2026-08-07T15:02:05.621356Z","title":"Med42 – evaluating fine-tuning strategies for medical llms: Full-parameter vs. parameter-efficient approaches,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:05.621356Z"},"links":{"cited_paper":"/paper/2404.14779","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:48c0dd3da4bbdb650959a6db0aa1140e060957735f9c0af35092f1163198f1e7","observation_id":"7c796a62-7f5a-42ac-8c29-6e6b8be5dbec","resolution":{"observed_at":"2026-08-07T15:02:05.621356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.12031","last_updated":"2023-08-17T17:19:02Z","snapshot_observed_at":"2026-08-06T16:28:29.854930Z","submitted_at":"2023-05-19T23:07:09Z","title":"Clinical Camel: An Open Expert-Level Medical Language Model with Dialogue-Based Knowledge Encoding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.12031","snapshot_observed_at":"2026-08-07T15:02:05.672437Z","title":"Clinical camel: An open expert-level medical language model with dialogue-based knowledge encoding,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:05.672437Z"},"links":{"cited_paper":"/paper/2305.12031","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:4cf42cec288abbd75f9502995334ad6ffe8629cf33f7e514accf4c0f6715a4fd","observation_id":"992ffb51-d662-4a81-ab2b-6ca34058509c","resolution":{"observed_at":"2026-08-07T15:02:05.672437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:13.274339Z","title":"Meditron-70b: Scaling medical pretraining for large language models,","venue":null,"work_id":"3eacfaae-e724-46ba-999c-e52a937cfacc","year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:05.831701Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:6b98128337a3fe445b6f5dae104df89e78a8ecc60d3f862d723780bcc7dc703a","observation_id":"0f4fa892-563d-481b-9ffc-1e0554f68c77","resolution":{"observed_at":"2026-08-07T15:02:13.394863Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.08247","last_updated":"2025-03-18T21:31:51Z","snapshot_observed_at":"2026-08-07T23:01:40.564640Z","submitted_at":"2023-04-14T11:28:08Z","title":"MedAlpaca -- An Open-Source Collection of Medical Conversational AI Models and Training Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.08247","snapshot_observed_at":"2026-08-07T15:02:05.922781Z","title":"Medalpaca – an open-source collection of medical conversational ai models and training data,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:05.922781Z"},"links":{"cited_paper":"/paper/2304.08247","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:6ef897599b60b187988c87536b22e939e1ea3e9a75f8e45baa4b6449080f19ab","observation_id":"0d17389c-b692-49f5-88cb-7b9f5c11f9de","resolution":{"observed_at":"2026-08-07T15:02:05.922781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1093/jamia/ocad104","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:08.991021Z","title":"ChatGPT and the clinical informatics board examination: the end of unproctored maintenance of certification?","venue":null,"work_id":"f6643754-f0bd-4e18-86fb-09540474a6e1","year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:05.989565Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:55bcdaadd5d78268ce84c144044263647815b3e7acbae863ff4f3ff6aeb5f211","observation_id":"34e413f6-317e-43a8-ba03-a49903e0d401","resolution":{"observed_at":"2026-08-07T15:02:09.035183Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:06.105502Z","title":"Performance of ChatGPT on USMLE: Potential for AI-assisted medical education using large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:06.105502Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:3bd086ca2c5fc867d8b2c0a1a2c65753eac05e277291b13c174898492d53e982","observation_id":"6a53e10c-b5f0-41f5-bd94-620c917bf9bd","resolution":{"observed_at":"2026-08-07T15:02:06.105502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:13.012156Z","title":"How Does ChatGPT Perform on the United States Medical Licensing Examination (USMLE)? The Implications of Large Language Models for Medical Education and Knowledge Assessment,","venue":null,"work_id":"794e2a77-4218-4990-8e77-a1ca57713550","year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:06.175193Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:27d3f1c74b2878e69640d75d675879e9e8baa28f94078c45a9cbe44c4ace85ef","observation_id":"7ca43031-3112-4a53-8b85-2c4bfbcbf81e","resolution":{"observed_at":"2026-08-07T15:02:13.138444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.13375","last_updated":"2023-04-12T16:48:39Z","snapshot_observed_at":"2026-07-06T15:07:11.623462Z","submitted_at":"2023-03-20T16:18:38Z","title":"Capabilities of GPT-4 on Medical Challenge Problems","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.13375","snapshot_observed_at":"2026-08-07T15:02:06.263833Z","title":"Capabilities of GPT-4 on Medical Challenge Problems,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:06.263833Z"},"links":{"cited_paper":"/paper/2303.13375","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:7f71d37ca5a073674d68d97f407268460c71cb8d73b18bb82778ce824652c2ef","observation_id":"ccf5b023-eedb-4ae1-9c7c-34151049bf1e","resolution":{"observed_at":"2026-08-07T15:02:06.263833Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:12.760076Z","title":"Trialling a Large Language Model (ChatGPT) in General Practice With the Applied Knowledge Test: Observational Study Demonstrating Opportunities and Limitations in Primary Care,","venue":null,"work_id":"ff24dcdf-d24c-4b96-b980-11f223230f31","year":null},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:06.367380Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:76cfa1bdd11ef2d53ed6cdb2bbeec8eeb546ab9c135146195e1aecfa6f82366c","observation_id":"7ea434a5-7605-427c-a156-480504eb66f0","resolution":{"observed_at":"2026-08-07T15:02:12.876540Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:12.251297Z","title":"Can Large Language Models Safely Address Patient Questions Following Cataract Surgery?","venue":null,"work_id":"c6f17d08-8a00-4fba-8d6a-629149bc5e4d","year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:06.565073Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:86025ed6dd2623ff48260f1445b724c883919178687ca7e72dc176145054b7b4","observation_id":"12c0d2f2-0c9d-4323-b9dc-397be47b9bcf","resolution":{"observed_at":"2026-08-07T15:02:12.367099Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:11.715105Z","title":"Benchmarking large language models’ performances for myopia care: a comparative analysis of ChatGPT-3.5, ChatGPT-4.0, and Google Bard,","venue":null,"work_id":"b1362ecc-904e-4b53-b8db-8e3f6ed7b6d5","year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:06.674469Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:040fcd716f88d493f147c928d396cfd5ed2481033da5ed0087b980b0fbda615a","observation_id":"515bf289-3aec-4d6a-a9d2-ddba1ebcb442","resolution":{"observed_at":"2026-08-07T15:02:12.095048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:11.266747Z","title":"Reasoning with large language models for medical question answering,","venue":null,"work_id":"861d1939-a995-425d-b3a7-2598e161497c","year":1964},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:06.797610Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:9594f30e1f1bd12b7dbe76595a3f4a4e16ad6105bd8a26a18c6b6f4c9a33cc89","observation_id":"611d8b7f-2510-46db-a5ed-78cab0fc3ae5","resolution":{"observed_at":"2026-08-07T15:02:11.424555Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:10.984444Z","title":"LARGE LANGUAGE MODELS CANNOT SELF- CORRECT REASONING YET,","venue":null,"work_id":"285b24e9-6373-4b8b-beb1-d5d710cdbbe2","year":2024},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:06.843950Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:effdc47b7e20152bae84f4fa920003e1d96d39ab7cac94138d6b42c15fe87172","observation_id":"fff2947a-95ac-4d12-944c-032250e05372","resolution":{"observed_at":"2026-08-07T15:02:11.140056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:10.594620Z","title":"Adaptive Chameleon or Stubborn Sloth:,","venue":null,"work_id":"6c722ee9-8c03-4140-9551-ddaced1e6eaa","year":2024},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:06.901674Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:42b7d42b819995952716701cf01804fbfeb5169f3f518d641c865c4eb0e66d21","observation_id":"ac4e2b73-7c80-4877-9b78-f98ca099b073","resolution":{"observed_at":"2026-08-07T15:02:10.763553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:10.295950Z","title":"Don’t Hallucinate, Abstain: Identifying LLM Knowledge Gaps via Multi-LLM Collaboration","venue":null,"work_id":"9e7a914e-731e-4e11-ac7a-bfd29eb10e54","year":null},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.022628Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:06db70902baee0714df5fb51d1f1ed3b278f47495c873ec83a5111c4bd213a9d","observation_id":"e06c1b25-ab5e-43bc-b541-fdd8c8d5340c","resolution":{"observed_at":"2026-08-07T15:02:10.423552Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:09.946820Z","title":"Exploring collaboration mechanisms for LLM agents: A social psychology view,","venue":null,"work_id":"fa444399-91ca-4700-ab3e-7cf222a811d5","year":2024},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.118020Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:c0c245aea12018cca69c49b435c32bf4262aea2a6ea570aa11e0ef21f7e267e5","observation_id":"fa868ea9-770b-4a39-a717-4ac986eca2ab","resolution":{"observed_at":"2026-08-07T15:02:10.087397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:09.583970Z","title":"Counterfactual debating with preset stances for hallucination elimination of llms,","venue":null,"work_id":"950d9448-a404-4765-a436-0c3ea6a5861a","year":null},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.219238Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:58dfb78e17975c72b41b470330be6da28d74f95ca397e36cfdbce649d5a82e8f","observation_id":"68489507-5e2d-4677-83fc-7b14593f6f49","resolution":{"observed_at":"2026-08-07T15:02:09.739336Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:07.388081Z","title":"One LLM is not Enough: Harnessing the Power of Ensemble Learning for Medical Question Answering,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.388081Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:41d96d9c69f0f55513dc00d672873befdc35865eeacd7cba423187cdb609afcc","observation_id":"ccb093c0-cc84-469f-bdda-bbdd8eea0de8","resolution":{"observed_at":"2026-08-07T15:02:07.388081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.11903","last_updated":"2023-01-10T23:07:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-28T02:33:07Z","title":"Chain-of-Thought Prompting Elicits Reasoning in Large Language Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.11903","snapshot_observed_at":"2026-08-07T15:02:07.471313Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.471313Z"},"links":{"cited_paper":"/paper/2201.11903","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:d95730553b3244db1e064614fc4c1fd5ef9eab91ca23429fca30d9022cf1641c","observation_id":"20c29ee5-b7aa-46b5-9836-c08769d9753d","resolution":{"observed_at":"2026-08-07T15:02:07.471313Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.11916","last_updated":"2023-01-29T05:14:17Z","snapshot_observed_at":"2026-08-07T04:02:08.445660Z","submitted_at":"2022-05-24T09:22:26Z","title":"Large Language Models are Zero-Shot Reasoners","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.11916","snapshot_observed_at":"2026-08-07T15:02:07.588376Z","title":"Large language models are zero-shot reasoners,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.588376Z"},"links":{"cited_paper":"/paper/2205.11916","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:e3eeb5301c2ebd64bbf1f29f92c13b454e4a2c83cfd06968a364b71eb5cb488a","observation_id":"9191cfbb-6da6-4588-a62d-48da69099284","resolution":{"observed_at":"2026-08-07T15:02:07.588376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1186/s12909-019-1605-z","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:08.863385Z","title":"Multivariable analysis of factors associated with USMLE scores across U.S. medical schools,","venue":null,"work_id":"258001a9-0137-483b-986a-0088191febee","year":2019},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.670413Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:9dc765f31bb39dd6e5760ed4ececa964cdffdd89a617435ce5d79e81541d3963","observation_id":"ecbd8b30-c832-4d9d-ad3e-668d19d1b922","resolution":{"observed_at":"2026-08-07T15:02:08.921281Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-08T06:16:25.839566Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T15:02:07.767358Z","title":"Mixtral of experts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.767358Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:b5593b5fa949cd532c948196a4419eaa89478495bfdaddb26b18958769fef0ce","observation_id":"b6e9e6ad-a41b-409a-8d67-e174dd393f44","resolution":{"observed_at":"2026-08-07T15:02:07.767358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T15:02:07.897800Z","title":"Llama 2: Open foundation and fine-tuned chat models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.897800Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:e98bc6ccd63e4ff666820334c92d72b4acdcca7c4699b185e3913dd6cfbdb80a","observation_id":"b7d0c431-08c2-4769-8804-95373363d289","resolution":{"observed_at":"2026-08-07T15:02:07.897800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.14314","last_updated":"2023-05-23T17:50:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-23T17:50:33Z","title":"QLoRA: Efficient Finetuning of Quantized LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.14314","snapshot_observed_at":"2026-08-07T15:02:07.959967Z","title":"Qlora: Efficient finetuning of quantized llms,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.959967Z"},"links":{"cited_paper":"/paper/2305.14314","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:14d9401ad1367c1122bc084303376b05578feb539b074f62cd8cd4ea1f1638ab","observation_id":"047e65b5-0d3b-449b-b67d-3212a72c01e7","resolution":{"observed_at":"2026-08-07T15:02:07.959967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11324","last_updated":"2024-07-01T22:28:01Z","snapshot_observed_at":"2026-08-04T15:07:29.209129Z","submitted_at":"2023-10-17T15:03:30Z","title":"Quantifying Language Models' Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11324","snapshot_observed_at":"2026-08-07T15:02:08.057788Z","title":"Quantifying Language Models’ Sensitivity to Spurious Features in Prompt Design or: How I learned to start worrying about prompt formatting,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:08.057788Z"},"links":{"cited_paper":"/paper/2310.11324","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:4222a9d8d5bdf1712632eb0e952e57813f4c839630e4f42506b5daab89a7a7ba","observation_id":"d4d06f39-afbc-4e11-947d-80b83b9585f3","resolution":{"observed_at":"2026-08-07T15:02:08.057788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:09.272662Z","title":"Improving Factuality and Reasoning in Language Models through Multiagent Debate","venue":null,"work_id":"8076c618-4e4c-4c52-90cc-bb35ddae6b00","year":null},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:08.188443Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:c713cc53c57f10023fa775ad383ca804a5e2503308feaab221cc1be3efed84c0","observation_id":"81563bc2-fe86-4676-b6f6-0f29cb59e984","resolution":{"observed_at":"2026-08-07T15:02:09.405653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.00367","last_updated":"2024-07-01T01:34:09Z","snapshot_observed_at":"2026-08-05T02:20:52.778218Z","submitted_at":"2024-02-01T06:11:49Z","title":"Don't Hallucinate, Abstain: Identifying LLM Knowledge Gaps via Multi-LLM Collaboration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.00367","snapshot_observed_at":"2026-08-07T15:02:08.244822Z","title":"Don’t Hallucinate, Abstain: Identifying LLM Knowledge Gaps via Multi-LLM Collaboration,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:08.244822Z"},"links":{"cited_paper":"/paper/2402.00367","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:adaa35856596ca1e49880da8cfafe40d2582a1fe0524767035c33025e4e62de7","observation_id":"9afeee92-4d2a-42f6-8a53-c48a442c7e24","resolution":{"observed_at":"2026-08-07T15:02:08.244822Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-07T15:02:08.351081Z","title":"Self-consistency improves chain of thought reasoning in language models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:08.351081Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:4366d4ca298f87954a7d1bb801892a49c50561a6379f49129752a5e1c1458ce1","observation_id":"0cdb15c5-516d-4ae5-9db1-7d8b4c6375d9","resolution":{"observed_at":"2026-08-07T15:02:08.351081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02124","last_updated":"2024-05-27T11:12:45Z","snapshot_observed_at":"2026-08-07T16:01:42.180251Z","submitted_at":"2023-10-03T15:05:52Z","title":"Exploring Collaboration Mechanisms for LLM Agents: A Social Psychology View","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02124","snapshot_observed_at":"2026-08-07T15:02:08.418344Z","title":"Exploring Collaboration Mechanisms for LLM Agents: A Social Psychology View,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:08.418344Z"},"links":{"cited_paper":"/paper/2310.02124","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:1d593ffbdcb1e6c6d9f55f36c8a9498efdf4acef01a8a3972834451e3dd439a3","observation_id":"f9b95562-1d14-488c-9cf1-2d86e06e9841","resolution":{"observed_at":"2026-08-07T15:02:08.418344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1002/9781118445112.stat05964","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:08.738892Z","title":null,"venue":null,"work_id":"1ec0e4b2-1051-497d-ba87-89ef75d3cc17","year":2014},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:08.513674Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:e57436d63cdaa2bec15333055e171fa67d3ec01082a48fd82e6e0597fb4744b1","observation_id":"079fbce1-db73-41f1-a41f-886d28c166c2","resolution":{"observed_at":"2026-08-07T15:02:08.821707Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.06782","last_updated":"2024-07-25T23:32:21Z","snapshot_observed_at":"2026-08-06T16:12:39.214839Z","submitted_at":"2024-02-09T21:05:01Z","title":"Debating with More Persuasive LLMs Leads to More Truthful Answers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.06782","snapshot_observed_at":"2026-08-07T15:02:08.628751Z","title":"Debating with more persuasive llms leads to more truthful answers,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:08.628751Z"},"links":{"cited_paper":"/paper/2402.06782","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:6159a446d25c9993ec6115536760ec1b95cdfde4dbbb96429270fd61da1773cc","observation_id":"e20efab2-1a1e-4050-935d-c6177babd4b7","resolution":{"observed_at":"2026-08-07T15:02:08.628751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:02:12.490918Z","title":"Available: https://mededu.jmir.org/2023/1/e46599","venue":null,"work_id":"3cf59588-f059-42b3-9b6e-9e241389d5ad","year":2023},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:06.462338Z"},"links":{"citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:82941b308179d6106b58c7d0970dabbd0feaea49cb877f29cb72caa9dcdcf93c","observation_id":"bae281e0-84d8-4ae1-ae98-baab67d6add2","resolution":{"observed_at":"2026-08-07T15:02:12.653097Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11514","last_updated":"2025-01-15T03:20:24Z","snapshot_observed_at":"2026-08-06T09:45:43.110436Z","submitted_at":"2024-06-17T13:21:23Z","title":"Counterfactual Debating with Preset Stances for Hallucination Elimination of LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11514","snapshot_observed_at":"2026-08-07T15:02:07.316036Z","title":"Available: https://arxiv.org/abs/2406.11514","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T15:02:07.316036Z"},"links":{"cited_paper":"/paper/2406.11514","citing_paper":"/paper/2505.16648"},"observation_digest":"sha256:c4164fc4fa105a7020e17f4ea7e124e92f143896508beb052a505243e53cbe19","observation_id":"b297728b-67e7-4b33-8e62-14aaf4bb33f1","resolution":{"observed_at":"2026-08-07T15:02:07.316036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.16648","last_updated":"2025-05-22T13:18:45Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T23:02:38.956575Z","submitted_at":"2025-05-22T13:18:45Z","title":"Collaboration among Multiple Large Language Models for Medical Question Answering"},"reference_resolution":{"displayed":33,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":3,"verified_fuzzy":13},"total_outbound_references":33},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 33 of 33 outbound references and 0 inbound Pith citation observations for arXiv:2505.16648."}