{"as_of":"2026-08-24T03:18:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:51cda2dd94405d44e3b19687332bbbfdb11d4bbbef82e4a847ac846189d6cad0","coverage":[{"denominator":14,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T13:42:02.925442Z","state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.13326/citation-record","integrity":"/paper/2608.13326/integrity","json":"/paper/2608.13326/citation-record.json","paper":"/paper/2608.13326"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:03.040698Z","title":"InProceedings of the 2021 ACM Conference on Fairness, Accountability, and Trans- parency, pages 375–385, New York, NY , USA","venue":null,"work_id":"bf7aa5a3-a2a7-41a6-b9ef-9bb493177669","year":2021},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.884888Z"},"links":{"citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:1f0149bf4156b84393343f878810216589e0ae233a7b9accbf52db71c65fccd0","observation_id":"1d8c5213-959e-4810-911a-aa8e985115cc","resolution":{"observed_at":"2026-08-14T13:42:03.044253Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:03.030023Z","title":"InFindings of the Association for Com- putational Linguistics: EMNLP 2024, pages 15012– 15032, Miami, Florida, USA","venue":null,"work_id":"fe98110c-3ee7-4a03-9664-85b5b9f64408","year":2024},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.895883Z"},"links":{"citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:08ded6ac65f9227901d406626885e5deda7887816b90bb2deb435730dad8bd2f","observation_id":"0c1c1950-c722-4c71-a183-643f3ad5db0d","resolution":{"observed_at":"2026-08-14T13:42:03.034110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-08-17T18:50:07.059564Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-14T13:42:02.899288Z","title":"Inioluwa Deborah Raji, Emily Denton, Emily M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.899288Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:88bfec50bf5876ff8a626300b77b22c8a6861dd4187456aa4ec7b223b3e8657d","observation_id":"46276019-60a1-48f9-90fb-999ec1c4afaf","resolution":{"observed_at":"2026-08-14T13:42:02.899288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:03.019044Z","title":"InAdvances in Neu- ral Information Processing Systems 36 (NeurIPS 2023)","venue":null,"work_id":"7f7007af-aa5d-4782-8141-cae3c4d51e63","year":2023},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.906605Z"},"links":{"citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:34a36b01b6d9293a18400b59d8ff4e1c1818dd6dca37f3ca0f5f55cebd155af7","observation_id":"cc6aaaa6-276d-4b28-9147-702ef90eef69","resolution":{"observed_at":"2026-08-14T13:42:03.023549Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:03.009319Z","title":"InProceedings of the 2025 Conference on Empirical Methods in Natural Language Processing, pages 9935–9960, Suzhou, China","venue":null,"work_id":"4d2e1c62-a2c9-49bc-9e16-2b4f5af2a0df","year":2025},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.910092Z"},"links":{"citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:688e5a82391c38dd58cbae5ed05b19fb718f4766cc2f03102a665eb4d33249ef","observation_id":"36493a88-cd77-44be-bf40-c4dab80a6d9c","resolution":{"observed_at":"2026-08-14T13:42:03.013106Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:03.000529Z","title":null,"venue":null,"work_id":"3b701ec2-2062-470a-92a4-29cf1de28501","year":2024},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.913579Z"},"links":{"citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:0d1ee3739deaf360e1afaa4297a4f73fca35aad5725f2956bc09b3868580ddbd","observation_id":"0a88cfcb-2fc6-475d-a25c-1e950c270fff","resolution":{"observed_at":"2026-08-14T13:42:03.003579Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.15092","last_updated":"2024-09-02T22:40:20Z","snapshot_observed_at":"2026-08-22T01:58:18.425105Z","submitted_at":"2024-05-23T22:38:58Z","title":"Dissociation of Faithful and Unfaithful Reasoning in LLMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.15092","snapshot_observed_at":"2026-08-14T13:42:02.921580Z","title":"arXiv preprint arXiv:2405.15092","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.921580Z"},"links":{"cited_paper":"/paper/2405.15092","citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:c0ac2228e159c7125219f2a8bd81531cff1ffcbd1251edd234bee2acf93d8b15","observation_id":"cfa3f0a2-da08-4e54-90bb-4975099adfe3","resolution":{"observed_at":"2026-08-14T13:42:02.921580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:02.989146Z","title":"InProceed- ings of the 2025 Conference on Empirical Methods in Natural Language Processing, pages 29425–29449, Suzhou, China","venue":null,"work_id":"b2104a83-f9ac-4439-a62a-8de073959146","year":2025},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.925442Z"},"links":{"citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:74fe85cb1ca923dd907fd76e90db34970d19b700aae3441ef8283e2e6319f9c8","observation_id":"170593be-43c5-4a18-9c38-48f4f4d8e1a8","resolution":{"observed_at":"2026-08-14T13:42:02.994544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:03.050160Z","title":"InFindings of the Association for Computational Linguistics: EMNLP 2020, pages 1307–1323, Online","venue":null,"work_id":"36c50433-5c73-4053-b4f6-e0fda898120d","year":2020},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.881235Z"},"links":{"citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:3591a42af1689a14b01f2cf7dc3e9361e5cdc3a1653ded9f7e94d81fe11b7c91","observation_id":"525bb544-4b6e-4c16-99e8-3be04f6a2144","resolution":{"observed_at":"2026-08-14T13:42:03.053283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:42:03.058594Z","title":"Association for Computational Linguistics","venue":null,"work_id":"c17cdad2-81b0-48b5-857a-8290d1758c5b","year":2021},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.877012Z"},"links":{"citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:63687399c0ee2fbcc9376b1562a8e717903c55a3fa53d0a9b32cfe5eda61c4a7","observation_id":"97fcfb99-e619-448d-9a2d-e4f8b3ee0ab7","resolution":{"observed_at":"2026-08-14T13:42:03.061472Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.13702","last_updated":"2023-07-17T01:08:39Z","snapshot_observed_at":"2026-08-13T18:02:27.155379Z","submitted_at":"2023-07-17T01:08:39Z","title":"Measuring Faithfulness in Chain-of-Thought Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.13702","snapshot_observed_at":"2026-08-14T13:42:02.888201Z","title":"Llama Team, AI @ Meta","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.888201Z"},"links":{"cited_paper":"/paper/2307.13702","citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:9f4865ab5663d2a37cd9d65b50005ff8d535330c797ca2ce35cec292fa696f31","observation_id":"e31dad8b-3027-408a-a0c0-9ded857c0fa7","resolution":{"observed_at":"2026-08-14T13:42:02.888201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-08-13T17:20:44.002518Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-14T13:42:02.892502Z","title":"Iman Mirzadeh, Keivan Alizadeh, Hooman Shahrokhi, Oncel Tuzel, Samy Bengio, and Mehrdad Farajtabar","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.892502Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:9a9151eabb70a822c122432a5e7ed03f2ea07f814cf5d0d2055bce848cc100fa","observation_id":"2b8d07bc-0591-499b-b766-4a0703a0f2b3","resolution":{"observed_at":"2026-08-14T13:42:02.892502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10573","last_updated":"2025-06-26T16:38:11Z","snapshot_observed_at":"2026-08-15T21:41:44.521608Z","submitted_at":"2025-05-13T20:36:22Z","title":"Measurement to Meaning: A Validity-Centered Framework for AI Evaluation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10573","snapshot_observed_at":"2026-08-14T13:42:02.902928Z","title":"Charlotte Siska, Katerina Marazopoulou, Melissa Ailem, and James Bono","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.902928Z"},"links":{"cited_paper":"/paper/2505.10573","citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:d83f1c02bf954a18b59e88a28f783ca1033a116e1f391713ceb20ad4a13f698d","observation_id":"387b1c4c-1805-4ae3-83f0-3715b414ce0d","resolution":{"observed_at":"2026-08-14T13:42:02.902928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.01048","last_updated":"2026-08-20T22:05:57Z","snapshot_observed_at":"2026-08-24T03:09:54.803654Z","submitted_at":"2026-05-01T19:23:33Z","title":"Compared to What? Baselines and Metrics for Counterfactual Prompting","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.01048","snapshot_observed_at":"2026-08-14T13:42:02.917263Z","title":"Accepted at COLM","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-14T13:42:02.917263Z"},"links":{"cited_paper":"/paper/2605.01048","citing_paper":"/paper/2608.13326"},"observation_digest":"sha256:91588ba22420f5dc043e807bebf2bf66c3e94f3a66c1d34b5117dfdc6fa0eb4c","observation_id":"e388ad43-b17b-4509-9862-8e0302b5c5c1","resolution":{"observed_at":"2026-08-14T13:42:02.917263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.13326","last_updated":"2026-08-13T14:49:47Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-18T12:20:49.282533Z","submitted_at":"2026-08-13T14:49:47Z","title":"Beyond Local Accuracy: A Protocol-Level Identifiability Audit for Controlled LLM Reasoning Evaluation"},"reference_resolution":{"displayed":14,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":7},"total_outbound_references":14},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 14 of 14 outbound references and 0 inbound Pith citation observations for arXiv:2608.13326."}