{"as_of":"2026-08-05T22:53:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b0a4809fc9d935a4e17f14db52a4a7133d402f00d2533dfd27d716e17bbc13b4","coverage":[{"denominator":13,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-24T02:06:53.585629Z","state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-05T06:32:48.257954+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2404.18923/citation-record","integrity":"/paper/2404.18923/integrity","json":"/paper/2404.18923/citation-record.json","paper":"/paper/2404.18923"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.03134","last_updated":"2024-10-05T20:30:40Z","snapshot_observed_at":"2026-08-05T19:38:58.849840Z","submitted_at":"2024-04-04T01:07:14Z","title":"Robust Pronoun Fidelity with English LLMs: Are they Reasoning, Repeating, or Just Biased?","version":3},"cited_work":{"arxiv_id":"2404.03134","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.03134","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In Proceedings of the 56th Annual Meeting of the Association for Compu- tational Linguistics (Volume 1: Long Papers) , pages 2126–2136, Melbourne, Australia","venue":null,"work_id":"0aa9bd76-e8c0-4471-b33f-7069033ea6d9","year":2023},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"cited_paper":"/paper/2404.03134","citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:b3e833864f5146167ddb511e4644ee32e135d9b17002cc9d484e44c8b1f791e7","observation_id":"32ebd788-32dd-46d3-aed3-b31474d611b4","resolution":{"observed_at":"2026-05-24T02:08:45.107794Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.15198","last_updated":"2024-04-05T16:52:55Z","snapshot_observed_at":"2026-07-06T18:04:30.291363Z","submitted_at":"2024-04-05T16:52:55Z","title":"Lossless and Near-Lossless Compression for Foundation Models","version":1},"cited_work":{"arxiv_id":"2404.15198","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.15198","snapshot_observed_at":"2026-07-04T14:39:57.844487Z","title":"In The Eleventh International Conference on Learning Representations, ICLR 2023, Kigali, Rwanda, May 1-5","venue":null,"work_id":"5c16e09b-1d38-49cc-ae27-9774b4ab81d8","year":2024},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"cited_paper":"/paper/2404.15198","citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:00bd24dc1cab3f3a5a6f556d249bc48e324aa834a19b1ec2190ef18ffd919544","observation_id":"0d95b0e6-e4c0-4889-87bf-176f003f54ee","resolution":{"observed_at":"2026-05-24T02:08:45.114043Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In Proceedings of the 2021 Confer- ence of the North American Chapter of the As- sociation for Computational Linguistics: Hu- man Language Technologies, pages 3849–3864, Online","venue":null,"work_id":"48a3df47-b63b-4ceb-bd11-4a5d4c3365ce","year":2021},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:f6750ba08f1e061426a57c6a4909809837cce5ff5b8466898b529d3703b15067","observation_id":"ea843537-bd90-4f2c-afb7-5a1fd2146f67","resolution":{"observed_at":"2026-05-24T02:08:46.294415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In Proceed- ings of the 58th Annual Meeting of the As- sociation for Computational Linguistics , pages 7871–7880, Online","venue":null,"work_id":"140ff99c-a075-45d8-940c-2f0bb80b8210","year":null},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:e8f001d8c5cce66b453fd8d1e4234529a1a247e8c533535703b12b73190eb052","observation_id":"d52b7aab-3f4a-4ef9-b7ea-75b40fb9e81c","resolution":{"observed_at":"2026-05-24T02:08:46.728908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1907.11692","last_updated":"2019-07-26T17:48:29Z","snapshot_observed_at":"2026-07-31T22:31:37.910868Z","submitted_at":"2019-07-26T17:48:29Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","version":1},"cited_work":{"arxiv_id":"1907.11692","doi":"10.1007/s10489-02203627-9","metadata_source":"pith","pith_arxiv_id":"1907.11692","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"RoBERTa: A Robustly Optimized BERT Pretraining Approach","venue":"cs.CL","work_id":"41fe12c4-e538-4890-a244-480650ed3078","year":2019},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"cited_paper":"/paper/1907.11692","citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:62755b02b6390d8de53d2ad955cc080f671ca69fc6db9b5e649bfdcd15ec86e1","observation_id":"586211ca-043b-41c1-b3d3-7be86b9c6c8e","resolution":{"observed_at":"2026-05-24T02:08:45.148408Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.01809","last_updated":"2024-07-15T12:21:56Z","snapshot_observed_at":"2026-08-05T15:26:10.962792Z","submitted_at":"2023-09-04T20:54:11Z","title":"Are Emergent Abilities in Large Language Models just In-Context Learning?","version":2},"cited_work":{"arxiv_id":"2309.01809","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2309.01809","snapshot_observed_at":"2026-07-01T23:36:22.709639Z","title":"Kyle Mahowald, Anna A","venue":null,"work_id":"5ca73dc5-1994-4c07-8ea6-3e21f82d9b1e","year":2024},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"cited_paper":"/paper/2309.01809","citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:b0952a3c1f44218e9664c7a5ddb594dd82e6dd6a7bf638764c3ff5a5bc8e6d24","observation_id":"38d6e5f6-cda5-4569-90f7-5b4ef3f5d6d4","resolution":{"observed_at":"2026-05-24T02:08:45.153483Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2401.00595","last_updated":"2024-05-06T10:20:26Z","snapshot_observed_at":"2026-07-06T17:10:24.956257Z","submitted_at":"2023-12-31T22:21:36Z","title":"State of What Art? A Call for Multi-Prompt LLM Evaluation","version":3},"cited_work":{"arxiv_id":"2401.00595","doi":"10.48550/arxiv.2401.00595","metadata_source":"arxiv_reference","pith_arxiv_id":"2401.00595","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR, abs/2401.00595","venue":"arXiv (Cornell University)","work_id":"9571587f-84df-407b-baa8-6c9557faa0c7","year":2024},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"cited_paper":"/paper/2401.00595","citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:cb9752b3baf71d34f8cd48c6715ebfcbf17c221958578cb5f329e604477af694","observation_id":"e7fe15f2-ee82-42fd-9a94-9449eb690554","resolution":{"observed_at":"2026-05-24T02:08:45.143108Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.11696","last_updated":"2024-04-01T17:34:34Z","snapshot_observed_at":"2026-07-06T16:09:12.888489Z","submitted_at":"2023-08-22T17:59:30Z","title":"Efficient Benchmarking of Language Models","version":5},"cited_work":{"arxiv_id":"2308.11696","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2308.11696","snapshot_observed_at":"2026-07-02T17:37:14.599642Z","title":"In Proceedings of the 57th Annual Meeting of the Association for Computational Linguistics , pages 4497–4510, Florence, Italy","venue":null,"work_id":"ce538a0c-6caf-4463-9416-6fc60638c615","year":2023},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"cited_paper":"/paper/2308.11696","citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:4ece3d308e1b955bbb38b0c810de09b622401781bd0c06e7a8619a5ecd5c25ea","observation_id":"aec9314c-16e6-4227-94d2-049a26902099","resolution":{"observed_at":"2026-05-24T02:08:45.131464Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"OpenAI blog, 1(8):9","venue":null,"work_id":"52de98bb-f6e2-45c7-bcc9-01d4f99a634a","year":null},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:98b19f4428cf9ef39a34b67c7699276ac936296bef6aacb87735e69eb9df1ae7","observation_id":"5ceec790-30b7-42db-8968-3a32bb47a0a5","resolution":{"observed_at":"2026-05-24T02:08:46.298378Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.13558","last_updated":"2023-12-21T03:51:08Z","snapshot_observed_at":"2026-07-06T17:06:16.961248Z","submitted_at":"2023-12-21T03:51:08Z","title":"The Truth is in There: Improving Reasoning in Language Models with Layer-Selective Rank Reduction","version":1},"cited_work":{"arxiv_id":"2312.13558","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2312.13558","snapshot_observed_at":"2026-07-04T10:09:43.986675Z","title":"The truth is in there: Improving reasoning in language models with layer-selective rank reduction.arXiv preprint arXiv:2312.13558","venue":null,"work_id":"00cf574f-75e4-43ee-af13-5ce4d110d3a6","year":2013},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"cited_paper":"/paper/2312.13558","citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:8f17eb05534a8273a35feb2fcffc058ba4b885d51ec9aa98f76895634f4249a4","observation_id":"1a557266-7cd3-4818-929d-f9a28db54faa","resolution":{"observed_at":"2026-05-24T02:08:45.125550Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-02T11:57:18.735747Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":"2307.09288","doi":"10.24963/ijcai.2025/706","metadata_source":"pith","pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","venue":"cs.CL","work_id":"68a5177f-d644-44c1-bd4f-4e5278c22f5d","year":2023},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:2752b4f6cb210aaa89f4f21c7937c5ccea8bd8b4f9886f3b5c55121cb46f5fa1","observation_id":"c9cf5e73-4b8d-4422-b065-beeb432dbc00","resolution":{"observed_at":"2026-05-24T02:08:45.119104Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12244","last_updated":"2025-05-27T06:49:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-04-24T16:31:06Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","version":3},"cited_work":{"arxiv_id":"2304.12244","doi":"10.48550/arxiv.2304.12244","metadata_source":"pith","pith_arxiv_id":"2304.12244","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WizardLM: Empowering large pre-trained language models to follow complex instructions","venue":"cs.CL","work_id":"fc22911b-0900-4ad2-b106-337f13279965","year":2023},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"cited_paper":"/paper/2304.12244","citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:b71d029d1bc9bf968feb70c997dbad7dcae32b1c7639147824d9dd2e103cce80","observation_id":"ed773011-57f7-4197-bad1-87acc9795a4d","resolution":{"observed_at":"2026-05-24T02:08:45.137093Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.03818","last_updated":"2025-04-24T21:12:33Z","snapshot_observed_at":"2026-08-05T22:31:36.261531Z","submitted_at":"2024-04-04T21:57:11Z","title":"PRobELM: Plausibility Ranking Evaluation for Language Models","version":4},"cited_work":{"arxiv_id":"2404.03818","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.03818","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"CoRR, abs/2404.03818","venue":null,"work_id":"b5ef720b-f901-445d-8eaa-4fdb4134cb9a","year":2017},"citing_paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models","version":5},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T02:06:53.585629Z"},"links":{"cited_paper":"/paper/2404.03818","citing_paper":"/paper/2404.18923"},"observation_digest":"sha256:8e625570915050b69b1c3de11abc9c364b388de5287739f847f0872a5d50f642","observation_id":"b3d357df-2617-4f84-9b46-f20eaa6c3ec9","resolution":{"observed_at":"2026-05-24T02:08:45.158812Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-05T06:32:48.257954+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2404.18923","last_updated":"2026-05-11T14:37:50Z","latest_version":5,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-02T09:44:06.336180Z","submitted_at":"2024-04-29T17:58:36Z","title":"Holmes: A Benchmark to Assess the Linguistic Competence of Language Models"},"reference_resolution":{"displayed":13,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":0,"verified_exact":7,"verified_fuzzy":3},"total_outbound_references":13},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-05T06:32:48.257954+00:00","source":"crossref"},{"observed_at":"2026-08-05T06:32:44.755628+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 13 of 13 outbound references and 0 inbound Pith citation observations for arXiv:2404.18923."}