{"as_of":"2026-08-07T16:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:dc38815275868897d37c56da2abdc641820fd17382c953baaeace95e175f3c96","coverage":[{"denominator":12,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":12,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:36:00.280571Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T19:03:03.350371Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T23:30:52.664737Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"cited_work":{"arxiv_id":"2507.22603","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.22603","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"org/abs/2507.22603","venue":null,"work_id":"755edd51-9ad6-4e31-a4a6-ac5ba92ca571","year":null},"citing_paper":{"arxiv_id":"2604.06456","last_updated":"2026-04-07T20:54:19Z","snapshot_observed_at":"2026-08-03T01:37:14.543340Z","submitted_at":"2026-04-07T20:54:19Z","title":"Context-Aware Dialectal Arabic Machine Translation with Interactive Region and Register Selection","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T19:03:03.350371Z"},"links":{"cited_paper":"/paper/2507.22603","citing_paper":"/paper/2604.06456"},"observation_digest":"sha256:40a243967dc05afb549dedcdbe31bd0dcfbbc3c98f5d3b3f6b33a369bc2a1c25","observation_id":"d292673a-38ce-4876-b9e2-315e12e1b824","resolution":{"observed_at":"2026-05-10T23:30:52.671051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2507.22603/citation-record","integrity":"/paper/2507.22603/integrity","json":"/paper/2507.22603/citation-record.json","paper":"/paper/2507.22603"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.475808Z","title":null,"venue":null,"work_id":"00c30cea-ae04-43b5-b67b-264f00bfcbd0","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.259136Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:a491ecef9fd76001a481094673872bdb041232f4b2f8e3577cfd9a6194ff670a","observation_id":"01da45ee-27e7-4952-83a4-46425ac1fb33","resolution":{"observed_at":"2026-08-06T11:36:00.480710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.458511Z","title":null,"venue":null,"work_id":"b6ae91df-ad8d-4a4d-b812-68b1444d7ad5","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.264374Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:cf4de7bcdc8ab7e543d08bb66260f08e35b89bfe7808101a185f71587736ea98","observation_id":"e06ab83d-1c55-4735-8fea-d57a18341fac","resolution":{"observed_at":"2026-08-06T11:36:00.463511Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.533750Z","title":"Dan Hendrycks, Collin Burns, Steven Basart, Andy Zou, Mantas Mazeika, Dawn Song, and Jacob Steinhardt","venue":null,"work_id":"49e9b3e1-136e-42dd-8d07-75ad1d967356","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.228330Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:1597f48450734b910e809b9aaf03ebd59597fd1e2fa53cb70ad1d6a40f029d1a","observation_id":"ac4e2a38-4a84-45c0-83f9-18e31d69a0b2","resolution":{"observed_at":"2026-08-06T11:36:00.539955Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10627","last_updated":"2024-07-15T11:26:07Z","snapshot_observed_at":"2026-07-06T18:46:22.753758Z","submitted_at":"2024-07-15T11:26:07Z","title":"Arena Learning: Build Data Flywheel for LLMs Post-training via Simulated Chatbot Arena","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10627","snapshot_observed_at":"2026-08-06T11:36:00.239773Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.239773Z"},"links":{"cited_paper":"/paper/2407.10627","citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:bac8d0adf891f74aef3f1b7b2570b4f5ea7de455aaa5063b714999bb56647e1c","observation_id":"157a8e67-c6f6-40ac-8138-da5596c037cc","resolution":{"observed_at":"2026-08-06T11:36:00.239773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.440333Z","title":"Evaluate the generated output by comparing it to the ground truth, considering how well it addresses the original prompt","venue":null,"work_id":"68d1fff2-4696-4e21-8465-85f337cf9364","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.269899Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:10f835459481d22bc20c1bb6ad39807b5f9cf29b61d97c80eb2725cdde08577d","observation_id":"1afaefda-ccae-4945-b94e-a2e33ff066bd","resolution":{"observed_at":"2026-08-06T11:36:00.445382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.423045Z","title":null,"venue":null,"work_id":"6587ed7c-4541-4dfb-aa8a-4e5bacc44f63","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.275656Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:46bde7510aa947623d2ed087aa435c701a50b76789539b989971570f76eceb9f","observation_id":"2e23c6ce-d51d-4c64-8042-f66350784495","resolution":{"observed_at":"2026-08-06T11:36:00.427852Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.403558Z","title":"score\": 3,","venue":null,"work_id":"68379abc-d1a4-49df-91c5-209c3490d374","year":null},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.280571Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:2e3514a6670dcd8e93a503022f7d2557b1915a057215d04398675acdcc5f6dbe","observation_id":"a1be0072-2efd-47be-8c2d-b37fd6a6c9bc","resolution":{"observed_at":"2026-08-06T11:36:00.410565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.515173Z","title":"In International Conference on Learning Representations","venue":null,"work_id":"02e5444a-3620-46fa-8042-70029b735e06","year":2024},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.233976Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:7b338a799c52657a6b30ff48f9553cf4d9a212a37f00193903ff5fd3baf7cbc0","observation_id":"32a637dc-4852-47fd-a38b-a61e37a53dee","resolution":{"observed_at":"2026-08-06T11:36:00.521004Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.05862","last_updated":"2022-04-12T15:02:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-12T15:02:38Z","title":"Training a Helpful and Harmless Assistant with Reinforcement Learning from Human Feedback","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.05862","snapshot_observed_at":"2026-08-06T11:36:00.215303Z","title":"arXiv preprint arXiv:2204.05862","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.215303Z"},"links":{"cited_paper":"/paper/2204.05862","citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:0d91c3ee8bca99a33c6040fb93b8b894ea1fd24301bc20817cb947de48699636","observation_id":"9c55c0a3-d89c-49d2-82b3-628f3da1c94d","resolution":{"observed_at":"2026-08-06T11:36:00.215303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.16149","last_updated":"2023-09-29T11:51:51Z","snapshot_observed_at":"2026-07-06T16:12:22.303188Z","submitted_at":"2023-08-30T17:07:17Z","title":"Jais and Jais-chat: Arabic-Centric Foundation and Instruction-Tuned Open Generative Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.16149","snapshot_observed_at":"2026-08-06T11:36:00.250729Z","title":"In Findings of the Associa- tion for Computational Linguistics: EMNLP 2023 , pages 1404–1422, Singapore","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.250729Z"},"links":{"cited_paper":"/paper/2308.16149","citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:65aeb28bad7b2d8ae7e22442c123b32962439d748236b8878514a93f6311c6b6","observation_id":"bd0921df-52e8-440c-92f8-00ef16da9de4","resolution":{"observed_at":"2026-08-06T11:36:00.250729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.05882","last_updated":"2024-08-12T00:46:39Z","snapshot_observed_at":"2026-08-03T09:38:13.558207Z","submitted_at":"2024-08-12T00:46:39Z","title":"Creating Arabic LLM Prompts at Scale","version":1},"cited_work":{"arxiv_id":"2408.05882","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.05882","snapshot_observed_at":"2026-08-06T11:36:00.358868Z","title":"Creating Arabic LLM Prompts at Scale","venue":"cs.CL","work_id":"8479839f-9894-4c5c-a208-5a7f8dc89536","year":2024},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.222651Z"},"links":{"cited_paper":"/paper/2408.05882","citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:960d8c41bb22d96249907937f90610c8d7faea3380420b6ee528612587a9f0ab","observation_id":"d3f97aaa-4e76-433a-8eda-725ae6fffd57","resolution":{"observed_at":"2026-08-06T11:36:00.366212Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:36:00.494765Z","title":"In Proceedings of the 31st International Conference on Computational Lin- guistics, pages 4186–4218, Abu Dhabi, UAE","venue":null,"work_id":"736a256d-1888-408a-a544-271f051c989a","year":2023},"citing_paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T11:36:00.245539Z"},"links":{"citing_paper":"/paper/2507.22603"},"observation_digest":"sha256:b4de85c4e09279b30ce7b671ee94e3f20fb7f6537b91ddf48fd5991bb4064bb3","observation_id":"06ffc0bd-6a50-4701-a2e3-efbf85ba8cfe","resolution":{"observed_at":"2026-08-06T11:36:00.500643Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.22603","last_updated":"2025-07-30T12:16:39Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T11:35:59.407051Z","submitted_at":"2025-07-30T12:16:39Z","title":"BALSAM: A Platform for Benchmarking Arabic Large Language Models"},"reference_resolution":{"displayed":12,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":6,"verified_exact":0,"verified_fuzzy":5},"total_outbound_references":12},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 12 of 12 outbound references and 1 inbound Pith citation observation for arXiv:2507.22603."}