{"as_of":"2026-08-08T21:27:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c989feebe79d665e3eba3c1bde7410a91ca5bad8f8c5944af23f2ad214f98775","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T06:00:10.327109Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2508.01006/citation-record","integrity":"/paper/2508.01006/integrity","json":"/paper/2508.01006/citation-record.json","paper":"/paper/2508.01006"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T06:00:10.281920Z","title":"Preprint, arXiv:2501.12948","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.281920Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:938c2cdbf5bf925aa33d176c22873737196dc1079b1f36ec2ac15178c13362fb","observation_id":"548a52aa-2253-4475-81d1-0927df9c063e","resolution":{"observed_at":"2026-08-06T06:00:10.281920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.02768","last_updated":"2026-04-30T13:20:38Z","snapshot_observed_at":"2026-07-06T21:03:50.078667Z","submitted_at":"2025-04-03T17:05:50Z","title":"MultiBLiMP 1.0: A Massively Multilingual Benchmark of Linguistic Minimal Pairs","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.02768","snapshot_observed_at":"2026-08-06T06:00:10.296880Z","title":"Preprint, arXiv:2504.02768","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.296880Z"},"links":{"cited_paper":"/paper/2504.02768","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:4084714a4cf2d4b38890be177e918e54880a69866ae1381823b7e994608a2275","observation_id":"47537837-aa1d-4b6d-8a6b-7c73a663c655","resolution":{"observed_at":"2026-08-06T06:00:10.296880Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.07474","last_updated":"2024-12-12T07:21:19Z","snapshot_observed_at":"2026-08-08T03:05:33.558929Z","submitted_at":"2024-11-12T01:26:41Z","title":"Controlled Evaluation of Syntactic Knowledge in Multilingual Language Models","version":2},"cited_work":{"arxiv_id":"2411.07474","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.07474","snapshot_observed_at":"2026-08-06T06:00:10.368393Z","title":"Controlled Evaluation of Syntactic Knowledge in Multilingual Language Models","venue":"cs.CL","work_id":"d3b0e394-9c89-418b-ab3c-4154c50d5286","year":2024},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.300890Z"},"links":{"cited_paper":"/paper/2411.07474","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:d48ffccc327a8f9ded0a6bd0823445f41150c85d766d021e76837990aebda8da","observation_id":"f6ac2c71-d32d-4fac-8f5a-8aa11ec5954a","resolution":{"observed_at":"2026-08-06T06:00:10.374786Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:17.003895Z","title":"In Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing: System Demonstrations, pages 175–184, Online and Punta Cana, Dominican Republic","venue":null,"work_id":"075ce614-6a9d-4c26-80fd-fdec98aca639","year":2021},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.304908Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:b24719f6015d4b0f3b9fed616fed9aa63980a975e2ad5a75939fc44457e5dba4","observation_id":"9b21b02a-1d0d-4cfb-b3bb-a103a75aaca7","resolution":{"observed_at":"2026-08-06T06:00:17.008156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:16.980800Z","title":"In Proceedings of the 2022 Conference on Empirical Methods in Natural Language Processing, pages 4606–4634, Abu Dhabi, United Arab Emirates","venue":null,"work_id":"e8489c7a-84e5-4188-bd7e-023e5486b179","year":2022},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.316058Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:d82825d9742b85a6aea9d8b9faa4a2a91c6c16254413ba187aa285005d393b74","observation_id":"325c05ce-bb73-4f46-91eb-d7f90fe50223","resolution":{"observed_at":"2026-08-06T06:00:16.984655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:16.969582Z","title":"https: //huggingface.co/large-traversaal/ Alif-1.0-8B-Instruct","venue":null,"work_id":"c801e162-5709-4e89-bdac-1162efce1727","year":2025},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.319635Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:93f47ff1ee77bae1640bf0d35356eb38cc16a56f112f7d722a51ad38b1d7b57c","observation_id":"658c8df3-eb7a-4f0c-90ec-0c39dc780deb","resolution":{"observed_at":"2026-08-06T06:00:16.973213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:16.958333Z","title":"In Proceedings of the 2021 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies, pages 483–498, Online","venue":null,"work_id":"81663400-8a3f-48c4-bbaa-92bbdd220ce4","year":2021},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.323430Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:570e98e2ac50efbcd9c1840038c3981d611d7f0796bd158bca4bed2f693bc93f","observation_id":"d6c2eb2c-9940-4d45-9194-ce4a9ebbffa2","resolution":{"observed_at":"2026-08-06T06:00:16.962267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-06T06:00:10.285644Z","title":"CoRR, abs/1810.04805","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.285644Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:a28a13e9b9076adff862809c0272f17650ee08e49ec803332c099e97ec43ff8f","observation_id":"1a95b647-5a3a-400a-b0b8-921d650a2b73","resolution":{"observed_at":"2026-08-06T06:00:10.285644Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:16.946140Z","title":null,"venue":null,"work_id":"c8a1341c-34b1-4055-99e4-f7f0e24901a4","year":2021},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.327109Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:c334a7005cea22f20c49572adffa284ec3a33384b6113eca4706b711817d86b6","observation_id":"833c7619-d4b4-4f6c-8b1c-ef0c6e9dde59","resolution":{"observed_at":"2026-08-06T06:00:16.950764Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:17.016280Z","title":"In Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing, pages 7038–7051, Online and Punta Cana, Dominican Republic","venue":null,"work_id":"b60b4150-9f7c-4fc4-aec3-2ba462244381","year":2021},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.293383Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:89548b49e6edb920a40bb0812efdbd86e1bf758bf37b9038780a24af2564c730","observation_id":"903cf07f-df61-470c-a178-bc27745dfb5a","resolution":{"observed_at":"2026-08-06T06:00:17.020156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.01786","last_updated":"2023-05-29T16:40:37Z","snapshot_observed_at":"2026-08-06T03:54:27.439090Z","submitted_at":"2022-11-03T13:19:32Z","title":"Crosslingual Generalization through Multitask Finetuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.01786","snapshot_observed_at":"2026-08-06T06:00:10.308640Z","title":"arXiv preprint arXiv:2211.01786","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.308640Z"},"links":{"cited_paper":"/paper/2211.01786","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:1372f34364f9fb159e7baee0ce8799ee4fa7b4a79c7312aa23d430a286422182","observation_id":"62d44409-ffa4-4a70-acb5-b3d8dcc8b068","resolution":{"observed_at":"2026-08-06T06:00:10.308640Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:16.991994Z","title":"In Findings of the Association for Computational Linguistics: EACL 2023 , pages 1581–1594, Dubrovnik, Croatia","venue":null,"work_id":"7214a3cf-0e3c-4ff6-ad68-5dbc55077650","year":2023},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.312630Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:f007d1603ef7f7d17e98f4812a90852da6fc369a49f48222a6b0fb11b1cbacf7","observation_id":"12c83f7b-ce1b-4839-b665-57a31b8abe16","resolution":{"observed_at":"2026-08-06T06:00:16.995724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-06T06:00:10.289493Z","title":"Preprint, arXiv:2407.21783","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.289493Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:3912b66eaa341fff8ce25a73d968adc97e8043b4584d525f0b6e034f27e4a936","observation_id":"c3f58f95-83ac-4dde-b071-2c9f97a73365","resolution":{"observed_at":"2026-08-06T06:00:10.289493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T06:00:10.277918Z","title":"Preprint, arXiv:2506.13487","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T06:00:10.277918Z"},"links":{"citing_paper":"/paper/2508.01006"},"observation_digest":"sha256:323dc2aab36185d11fbf78a0cbf6a1bba3163eeb5dfebcc9c5010bd561c84421","observation_id":"b6b58527-6c82-42f4-836d-554e91e84c54","resolution":{"observed_at":"2026-08-06T06:00:10.277918Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2508.01006","last_updated":"2025-08-01T18:16:37Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T06:00:09.349166Z","submitted_at":"2025-08-01T18:16:37Z","title":"UrBLiMP: A Benchmark for Evaluating the Linguistic Competence of Large Language Models in Urdu"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":6},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2508.01006."}