{"as_of":"2026-08-08T02:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:96c942cc055d9f14fac3130667276a70846d9473966e20338eb753351dfe2f56","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:13:33.624540Z","state":"measured"},{"denominator":25,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":25,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T05:15:29.381495Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00250","snapshot_observed_at":"2026-08-01T05:15:29.381495Z","title":"arXiv preprint arXiv:2506.00250 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22300","last_updated":"2026-07-24T13:44:50Z","snapshot_observed_at":"2026-08-01T05:15:26.064381Z","submitted_at":"2026-07-24T13:44:50Z","title":"Biomedical Machine Translation for Low-Resource Arabic-Script Languages via Cross-Lingual Transfer and LoRA Adapter Merging","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T05:15:29.381495Z"},"links":{"cited_paper":"/paper/2506.00250","citing_paper":"/paper/2607.22300"},"observation_digest":"sha256:1936b9138db365d2bc5616af637d21a467432df452495c4b485bafe5533fd18c","observation_id":"2ccf1708-174f-45a7-95f7-37afece052a3","resolution":{"observed_at":"2026-08-01T05:15:29.381495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.00250/citation-record","integrity":"/paper/2506.00250/integrity","json":"/paper/2506.00250/citation-record.json","paper":"/paper/2506.00250"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:37.147323Z","title":"Expert Evaluation: The model follows a Western protocol; how- ever, local clinical practice requires urgent biopsy due to high mor- tality risk","venue":null,"work_id":"9d02f6ba-9368-42f6-ad3e-94d0d9176ddf","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:31.959523Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:ee43ec8eeb52c344ada2525105891f9392b5ff43fbf2f1bf05edb5607d62cc82","observation_id":"f5533fe7-f322-436d-8ea3-9668fb19fc61","resolution":{"observed_at":"2026-08-07T12:13:37.276094Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:36.955611Z","title":"Expert Evaluation: The model selected a technically true but con- textually incorrect answer; expert notes ambiguity in phrasing and clinical intent","venue":null,"work_id":"0e0f1219-69a9-4c13-8904-abd81892d900","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:32.056332Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:2475253c8fd676621035bb67c912b900addb4bd59ef42e4ac4656a53145010ce","observation_id":"d1b784b7-d21b-4b88-9533-7235fb2a6ea5","resolution":{"observed_at":"2026-08-07T12:13:37.055330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:36.718723Z","title":"Expert Evaluation: The patient’s immunosuppression requires a different clinical approach, which the model failed to identify","venue":null,"work_id":"236c3fd1-c1f1-4409-b4a9-d4bf3de3a996","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:32.168595Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:10c7c8cc33a1b5e7967830c4dbce6e8110e1b9aaeb162d4360ffee01cb9d52b9","observation_id":"87fca736-cd33-4b5b-aa1e-00d915312cd3","resolution":{"observed_at":"2026-08-07T12:13:36.843318Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:38.384752Z","title":"ACM T ransactions on Computing for Healthcare, 3(1):1–23","venue":null,"work_id":"8f4c6666-0579-4fdf-b853-8445f8c3e2d8","year":2024},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:31.354430Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:f89476488ff095544cace11e04f4dc72d243dd2c7453fda7c246561969cf3224","observation_id":"79f3da1d-db18-4fdd-b1b9-06ab12612b71","resolution":{"observed_at":"2026-08-07T12:13:38.508607Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:34.787247Z","title":null,"venue":null,"work_id":"1d340dbd-210d-4a81-abc8-407993f898ad","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:33.071965Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:2bbca5344a71c558611a4b941b5cda13c7c98be0ccf1464abb0c66b1b3de2d1c","observation_id":"5d4f9807-8edd-46c2-92b5-05b617dcb905","resolution":{"observed_at":"2026-08-07T12:13:34.901288Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:34.560516Z","title":"CoT\": \"your step-by-step reasoning","venue":null,"work_id":"69c6b85b-1838-48d6-8ca1-c9b9d4246411","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:33.190736Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:c2436c9f8f194f5be18be6ca20bcf9b062b6fc0cf4cc577d3082f7564646b10a","observation_id":"11ae05f1-b7f8-4dca-aeb7-b7537db77fd5","resolution":{"observed_at":"2026-08-07T12:13:34.683065Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:37.882172Z","title":null,"venue":null,"work_id":"b2a3e4d4-c694-47ae-b6fc-da4739d6ebfa","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:31.582306Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:b394aff2850bb0ea2ab951c0c4a5c5bdca8cc9b4daaa28b6e9ebaf89858584fd","observation_id":"d09d3fb0-ba27-4ca5-b5a0-9ed9ae29be00","resolution":{"observed_at":"2026-08-07T12:13:38.016159Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:37.670864Z","title":null,"venue":null,"work_id":"f0893888-1781-4790-9671-3312eaa4bea1","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:31.690237Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:f4072da3e945979f58c91d4305fb98484f60c60bf3b03096c31d68f027f87ea1","observation_id":"333772bc-b118-45bd-8463-5695d3ee4b87","resolution":{"observed_at":"2026-08-07T12:13:37.773092Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:37.387788Z","title":"For each example, we highlight the clinical context, the correct answer, the model’s response, and a summary of the ex- pert’s evaluation","venue":null,"work_id":"dbed448f-039b-4709-b5e8-ba2f2f7fdd08","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:31.818911Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:3d851f00f8bfef3cadd0a7d18e06e0dea9de4488d1bbec40eb6c2401b4573f63","observation_id":"35c8c183-e759-4179-b9c4-3b6030641113","resolution":{"observed_at":"2026-08-07T12:13:37.523363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:36.214209Z","title":"Few-shot Prompt You are a medical expert tasked with answering multiple-choice medical questions","venue":null,"work_id":"70d4c6e1-95d4-4626-a498-6ebaaa1f9ecd","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:32.435042Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:71516a0767a64bbce9a69387d7d2502493e8c6d1e1d2ba67107eaa4fb8ba2f13","observation_id":"a570c20d-c27b-4821-bb8a-7f76be691e63","resolution":{"observed_at":"2026-08-07T12:13:36.331963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:36.496069Z","title":"Expert Evaluation: Model lacks pharmacologic mechanism knowledge and defaults to common treatments","venue":null,"work_id":"3c608b39-e557-40b6-9593-37e3ea176291","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:32.260041Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:cc4c48f76089ef1acac1bc684b0b744a93109535250b11a46b96e839bb4dbf2b","observation_id":"57cdafd6-93cf-4792-b6e7-2bf5e66e8475","resolution":{"observed_at":"2026-08-07T12:13:36.621196Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:34.320558Z","title":null,"venue":null,"work_id":"444a713d-84d7-4461-a367-e5c38d64b194","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:33.289303Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:f9c2fde02fed5b11a4e2115ba722eee83dce82c3d0df308cf345998422f70b7e","observation_id":"c2835af1-6185-4b20-8f16-497a74057d29","resolution":{"observed_at":"2026-08-07T12:13:34.442456Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:35.979434Z","title":"For each question, please:","venue":null,"work_id":"30be9dba-90bc-4fa9-9f4c-0ad9e30af784","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:32.575356Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:85101f7b9f3171a1313cfda2e551bd7dcd3158ca33879e35e1f0a52530462ba2","observation_id":"28642780-5928-4511-9493-a6c717ab7fa6","resolution":{"observed_at":"2026-08-07T12:13:36.110162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:35.717893Z","title":null,"venue":null,"work_id":"c38c05a8-80f2-4719-889e-ba880017469a","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:32.708500Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:f8377ac2bde60b33e1584de45d6412263cd294d77247a36ca7d624ef0d54f591","observation_id":"0043c02f-c76f-4440-bcf6-073b3d66d4e8","resolution":{"observed_at":"2026-08-07T12:13:35.842329Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:35.408083Z","title":null,"venue":null,"work_id":"7b705170-59d4-4729-a056-09a888c593c5","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:32.811868Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:2885fb10469a3c3937fa3fa92d0f955c971cf6a62b66d94ee216e8ec530f1654","observation_id":"d0ddb1d1-3820-45b4-a157-8362ef4713ff","resolution":{"observed_at":"2026-08-07T12:13:35.579474Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:35.243752Z","title":null,"venue":null,"work_id":"1a6ee726-367a-4136-bfea-5b07fc99c03f","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:32.892532Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:868bbaee9f1e5e9b77f27fe65c937019f139513e143c8a620d2fa1be8f167ab4","observation_id":"1071749f-28db-419a-b6f7-11e5e9326468","resolution":{"observed_at":"2026-08-07T12:13:35.316209Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:35.006192Z","title":null,"venue":null,"work_id":"7d4fa96b-fa1a-40dc-a201-c35cefe41b32","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:32.979952Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:acba08832b0fbeb024ec4cb485c053a61df713d861ed50a2d2f61d77f072ea5f","observation_id":"1232599a-57fc-41f8-b0bf-ed2ef52e343c","resolution":{"observed_at":"2026-08-07T12:13:35.138642Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:34.133330Z","title":"T able 3: Distribution of extracted Persian medical terms","venue":null,"work_id":"f49fdd85-bf67-4f7a-b56b-8480aeba5ca4","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:33.406130Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:d403e4f9551f0a8614cfc530a4e3b8d96dfc0a02f74051b1796e65e831f7daca","observation_id":"a81ee56f-5fd3-4150-ad55-fd6a8bfa56bc","resolution":{"observed_at":"2026-08-07T12:13:34.230043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:33.915782Z","title":"Models are sorted by average performance","venue":null,"work_id":"fd8f8bcd-3e8d-420c-95e0-789bb55091ae","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:33.511059Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:c27883f092ee23f5d09206a266a37470ac39b21a225d02d8281921f0dc7604c3","observation_id":"d7154dfd-fa04-47ae-adcb-39a2e3df5def","resolution":{"observed_at":"2026-08-07T12:13:34.042820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:33.742005Z","title":"Repre- sentative examples for each category are provided below","venue":null,"work_id":"a01dfece-1476-43a5-9976-513ee5250000","year":null},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:33.624540Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:5c8e94f70f326af5c2e3ee62c7a14cb5181feb9acceecdf2f4c034996c28052a","observation_id":"38f7dc6f-680e-4545-a1d3-3f463d2dab56","resolution":{"observed_at":"2026-08-07T12:13:33.827945Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:38.874570Z","title":"Josepha Campinha-Bacote","venue":null,"work_id":"1084555e-975b-41ce-918a-c93dfc0bfa22","year":2002},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:31.162016Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:c2bb637b3d361f16e0cf0bea4c285c92f6dc160590223ddbe031ad52f68aea4d","observation_id":"d700b77d-4915-46d4-bdf8-7d80c04c6ed6","resolution":{"observed_at":"2026-08-07T12:13:38.999641Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:38.627299Z","title":"Neural Pro- cessing Letters, 53(6):3831–3847","venue":null,"work_id":"d15099c5-8153-44a2-bf49-d5fb3d3187a1","year":2020},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:31.254863Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:f445090112228a0cb7886120b8f16a70fcc973d725f76cebeb1f74e431caa345","observation_id":"7dbe64bb-bf4e-4fbe-ab9e-bdc0994a8f12","resolution":{"observed_at":"2026-08-07T12:13:38.758968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:38.131566Z","title":"Laurence J","venue":null,"work_id":"a3ea3d15-350e-4644-a26d-3ba77b8f74eb","year":2001},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:31.496739Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:6773f8cdee08b24102becd196fba2c1885c9ae335408f2cbc0647d265ac34198","observation_id":"86658fb0-1204-4fff-8aa0-faac04349f9f","resolution":{"observed_at":"2026-08-07T12:13:38.265643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:13:39.104575Z","title":"Artificial Intelligence in Medicine , 155:102938","venue":null,"work_id":"17e57553-5faf-43f2-bc28-ed7c5c775eee","year":2010},"citing_paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:13:31.088923Z"},"links":{"citing_paper":"/paper/2506.00250"},"observation_digest":"sha256:48a1b244d248e0b432cc34599c92a654d23e1aafbbd7f0764741d4580799b8eb","observation_id":"e9e32653-c1af-4426-9573-5e20002f85c0","resolution":{"observed_at":"2026-08-07T12:13:39.204341Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.00250","last_updated":"2026-05-26T14:36:48Z","latest_version":4,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T12:07:01.978365Z","submitted_at":"2025-05-30T21:34:30Z","title":"PersianMedQA: Evaluating Large Language Models on a Persian-English Bilingual Medical Question Answering Benchmark"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":8,"verified_exact":0,"verified_fuzzy":16},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 1 inbound Pith citation observation for arXiv:2506.00250."}