{"as_of":"2026-08-09T23:37:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9814b7ef5aa76926e0a8c97e254a093fb451826ce43ee084c8476db3a1cfecb8","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":5,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":5,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":5,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":5,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-29T05:04:46.900824Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T20:00:08.314046Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.03427","last_updated":"2025-08-22T11:58:27Z","snapshot_observed_at":"2026-08-09T17:26:28.845712Z","submitted_at":"2025-05-06T11:07:26Z","title":"MedArabiQ: Benchmarking Large Language Models on Arabic Medical Tasks","version":2},"cited_work":{"arxiv_id":"2505.03427","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03427","snapshot_observed_at":"2026-07-04T20:00:08.314046Z","title":"Medarabiq: Benchmarking large language models on arabic medical tasks","venue":null,"work_id":"b3e53be0-1ddf-4b27-9ac9-fe4bc04829c8","year":2025},"citing_paper":{"arxiv_id":"2604.03395","last_updated":"2026-04-03T18:54:59Z","snapshot_observed_at":"2026-08-07T08:50:57.022194Z","submitted_at":"2026-04-03T18:54:59Z","title":"Are Arabic Benchmarks Reliable? QIMMA's Quality-First Approach to LLM Evaluation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-13T19:35:09.159337Z"},"links":{"cited_paper":"/paper/2505.03427","citing_paper":"/paper/2604.03395"},"observation_digest":"sha256:5d52334c9d5be39717a2b99fd68321b5587cc89aefff5cd7894b38467e686340","observation_id":"4fda1bac-255a-4e42-91e6-981cd0a15e47","resolution":{"observed_at":"2026-05-13T19:38:10.539796Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03427","last_updated":"2025-08-22T11:58:27Z","snapshot_observed_at":"2026-08-09T17:26:28.845712Z","submitted_at":"2025-05-06T11:07:26Z","title":"MedArabiQ: Benchmarking Large Language Models on Arabic Medical Tasks","version":2},"cited_work":{"arxiv_id":"2505.03427","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03427","snapshot_observed_at":"2026-07-04T20:00:08.314046Z","title":"Medarabiq: Benchmarking large language models on arabic medical tasks","venue":null,"work_id":"b3e53be0-1ddf-4b27-9ac9-fe4bc04829c8","year":2025},"citing_paper":{"arxiv_id":"2605.09584","last_updated":"2026-05-10T14:51:31Z","snapshot_observed_at":"2026-07-06T23:21:39.966502Z","submitted_at":"2026-05-10T14:51:31Z","title":"CLR-voyance: Reinforcing Open-Ended Reasoning for Inpatient Clinical Decision Support with Outcome-Aware Rubrics","version":1},"reference_index":150,"source":"arxiv_source","source_observed_at":"2026-05-12T04:32:16.930291Z"},"links":{"cited_paper":"/paper/2505.03427","citing_paper":"/paper/2605.09584"},"observation_digest":"sha256:1cfce59e4eef7022cbd5e7bdbbd55bc5fc6c8c962ec3bf7b7eaf028009ad0504","observation_id":"e27f1baf-81c9-4523-a584-350878d9c629","resolution":{"observed_at":"2026-05-12T06:11:23.563000Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03427","last_updated":"2025-08-22T11:58:27Z","snapshot_observed_at":"2026-08-09T17:26:28.845712Z","submitted_at":"2025-05-06T11:07:26Z","title":"MedArabiQ: Benchmarking Large Language Models on Arabic Medical Tasks","version":2},"cited_work":{"arxiv_id":"2505.03427","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03427","snapshot_observed_at":"2026-07-04T20:00:08.314046Z","title":"Medarabiq: Benchmarking large language models on arabic medical tasks","venue":null,"work_id":"b3e53be0-1ddf-4b27-9ac9-fe4bc04829c8","year":2025},"citing_paper":{"arxiv_id":"2606.21460","last_updated":"2026-06-19T14:16:13Z","snapshot_observed_at":"2026-08-09T17:11:49.520059Z","submitted_at":"2026-06-19T14:16:13Z","title":"Evaluation of Small Language Models for Arabic Language Processing","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-26T14:22:37.152936Z"},"links":{"cited_paper":"/paper/2505.03427","citing_paper":"/paper/2606.21460"},"observation_digest":"sha256:fd78b5877a7cc57c145c5f955b46564b0479fb56658b51594c5fc70848cc6a87","observation_id":"8e19dba3-5008-4da9-ac22-2a88352ffc22","resolution":{"observed_at":"2026-07-04T06:39:36.966178Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03427","last_updated":"2025-08-22T11:58:27Z","snapshot_observed_at":"2026-08-09T17:26:28.845712Z","submitted_at":"2025-05-06T11:07:26Z","title":"MedArabiQ: Benchmarking Large Language Models on Arabic Medical Tasks","version":2},"cited_work":{"arxiv_id":"2505.03427","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03427","snapshot_observed_at":"2026-07-04T20:00:08.314046Z","title":"Medarabiq: Benchmarking large language models on arabic medical tasks","venue":null,"work_id":"b3e53be0-1ddf-4b27-9ac9-fe4bc04829c8","year":2025},"citing_paper":{"arxiv_id":"2606.25651","last_updated":"2026-06-26T15:03:28Z","snapshot_observed_at":"2026-08-09T18:57:56.008750Z","submitted_at":"2026-06-24T10:07:59Z","title":"MedGuards: Multi-Agent System for Reliable Medical Error Detection and Correction","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-25T20:53:30.125527Z"},"links":{"cited_paper":"/paper/2505.03427","citing_paper":"/paper/2606.25651"},"observation_digest":"sha256:120a89035ba2842a2bb02fa8a1253cfe4d130c93dfd7985773186291c2f477d3","observation_id":"c50b4c80-2ca4-4fae-ac50-d5c292fbaab0","resolution":{"observed_at":"2026-07-04T20:00:08.315695Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.03427","last_updated":"2025-08-22T11:58:27Z","snapshot_observed_at":"2026-08-09T17:26:28.845712Z","submitted_at":"2025-05-06T11:07:26Z","title":"MedArabiQ: Benchmarking Large Language Models on Arabic Medical Tasks","version":2},"cited_work":{"arxiv_id":"2505.03427","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.03427","snapshot_observed_at":"2026-07-04T20:00:08.314046Z","title":"Medarabiq: Benchmarking large language models on arabic medical tasks","venue":null,"work_id":"b3e53be0-1ddf-4b27-9ac9-fe4bc04829c8","year":2025},"citing_paper":{"arxiv_id":"2606.25651","last_updated":"2026-06-26T15:03:28Z","snapshot_observed_at":"2026-08-09T18:57:56.008750Z","submitted_at":"2026-06-24T10:07:59Z","title":"MedGuards: Multi-Agent System for Reliable Medical Error Detection and Correction","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-29T05:04:46.900824Z"},"links":{"cited_paper":"/paper/2505.03427","citing_paper":"/paper/2606.25651"},"observation_digest":"sha256:dc623a2300aa8c9751e72ee780348a960cc7dd729c8b92c68c4ccbe51689c83e","observation_id":"b53f6d75-ede0-448f-a730-ff9d9fa978f1","resolution":{"observed_at":"2026-06-29T18:33:51.161230Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.03427/citation-record","integrity":"/paper/2505.03427/integrity","json":"/paper/2505.03427/citation-record.json","paper":"/paper/2505.03427"},"outbound":[],"paper":{"arxiv_id":"2505.03427","last_updated":"2025-08-22T11:58:27Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-09T17:26:28.845712Z","submitted_at":"2025-05-06T11:07:26Z","title":"MedArabiQ: Benchmarking Large Language Models on Arabic Medical Tasks"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 5 inbound Pith citation observations for arXiv:2505.03427."}