{"as_of":"2026-08-08T05:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:461f7278623f20287df05170368cd19453996c9a5479c3c0d1cc7a0e97f494a6","coverage":[{"denominator":9,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:42:39.596354Z","state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.24069/citation-record","integrity":"/paper/2505.24069/integrity","json":"/paper/2505.24069/citation-record.json","paper":"/paper/2505.24069"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2401.04088","last_updated":"2024-01-08T18:47:34Z","snapshot_observed_at":"2026-08-07T13:04:50.040909Z","submitted_at":"2024-01-08T18:47:34Z","title":"Mixtral of Experts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.04088","snapshot_observed_at":"2026-08-07T12:42:38.862158Z","title":"Jiang, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-07T12:33:49.086526Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:38.862158Z"},"links":{"cited_paper":"/paper/2401.04088","citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:d9db9ea8bf9a5c947de0ec334a398a7aae08c12ca108be3db821a8f609bac583","observation_id":"c931fb64-0f01-4a99-a450-5eff50ef3507","resolution":{"observed_at":"2026-08-07T12:42:38.862158Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.09074","last_updated":"2024-06-12T08:55:13Z","snapshot_observed_at":"2026-07-06T17:16:43.078022Z","submitted_at":"2024-01-17T09:23:59Z","title":"Code Simulation Challenges for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.09074","snapshot_observed_at":"2026-08-07T12:42:39.128432Z","title":"Malfa, E","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-07T12:33:49.086526Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.128432Z"},"links":{"cited_paper":"/paper/2401.09074","citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:115eb92e50318061f2efca6c28fb8635688280709c1d9d27817d715bc545e69d","observation_id":"f9b46fef-c915-48e2-8cf3-c2d7b4a95500","resolution":{"observed_at":"2026-08-07T12:42:39.128432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:39.368290Z","title":"acl-long.560/","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-07T12:33:49.086526Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":560,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.368290Z"},"links":{"citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:42277b95b184a965ccb8f639a6968acb3c6d985f4960e0435cb0b1d6aa1962e6","observation_id":"520f27ae-e1ca-41b4-9077-2fdfa797cab9","resolution":{"observed_at":"2026-08-07T12:42:39.368290Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:40.050115Z","title":"$” to ensure a unique structure. The final state is a pre-order traversal collecting edge labels, with child edges visited in lexicographical order and “$","venue":null,"work_id":"4465e508-aad7-4074-b70f-e845b619b5d9","year":2024},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-07T12:33:49.086526Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":765,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.596354Z"},"links":{"citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:b5d1430d9c644a15fd7c3e6a9a9f293fcd06a01e370acf690aca18623710d2b5","observation_id":"017e5cc6-e29c-4578-8d33-a18a77c18dd1","resolution":{"observed_at":"2026-08-07T12:42:40.136462Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:40.247259Z","title":"Jain, N., Han, K., Gu, A., Li, W.-D., Yan, F., Zhang, T., Wang, S., Solar-Lezama, A., Sen, K., and Stoica, I","venue":null,"work_id":"502a2d88-4db3-4a51-bf93-e36fd767a545","year":null},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-07T12:33:49.086526Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:38.831254Z"},"links":{"citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:24cd4cbd3ae1232ae8c720e4122835f4316495e41467338d3ea6479de9dfd69e","observation_id":"22b4c08b-010c-4700-bf8e-3231496757eb","resolution":{"observed_at":"2026-08-07T12:42:40.332011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04244","last_updated":"2024-06-06T16:41:39Z","snapshot_observed_at":"2026-07-30T15:43:06.151242Z","submitted_at":"2024-06-06T16:41:39Z","title":"Benchmark Data Contamination of Large Language Models: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04244","snapshot_observed_at":"2026-08-07T12:42:39.495637Z","title":"Wang, B., Yue, X., Su, Y ., and Sun, H","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-07T12:33:49.086526Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.495637Z"},"links":{"cited_paper":"/paper/2406.04244","citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:12c21d70787ee83bfbf5a07c9ebe8c562e501dc267d1b9c727eb7caf1c2b26f5","observation_id":"42df52bc-c515-45b3-9f28-9356b6f805a8","resolution":{"observed_at":"2026-08-07T12:42:39.495637Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:42:39.260078Z","title":"doi: 10.1145/3564240","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-07T12:33:49.086526Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.260078Z"},"links":{"citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:a8dab60ea0bb391ca5b3e030441776768ed81ae9bfbb643c9899b8965db8c6ee","observation_id":"762da522-2267-4dee-9448-65391b593145","resolution":{"observed_at":"2026-08-07T12:42:39.260078Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.07314","last_updated":"2026-07-28T17:58:21Z","snapshot_observed_at":"2026-08-05T16:41:56.624766Z","submitted_at":"2024-09-11T14:44:51Z","title":"MEDIC: Comprehensive Evaluation of Leading Indicators for LLM Safety and Utility in Clinical Applications","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.07314","snapshot_observed_at":"2026-08-07T12:42:39.012433Z","title":"Kanithi, P., Christophe, C., Pimentel, M","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-07T12:33:49.086526Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:39.012433Z"},"links":{"cited_paper":"/paper/2409.07314","citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:a48f9c7a1a1b103dc19d91518a668ab1b65f432337f12409165303c8b1a0592b","observation_id":"46b88ea4-36b7-4e71-a9ad-d96715b6329a","resolution":{"observed_at":"2026-08-07T12:42:39.012433Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.15268","last_updated":"2025-01-27T11:35:04Z","snapshot_observed_at":"2026-07-06T19:20:37.430389Z","submitted_at":"2024-09-23T17:58:07Z","title":"Style Outweighs Substance: Failure Modes of LLM Judges in Alignment Benchmarking","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.15268","snapshot_observed_at":"2026-08-07T12:42:38.753358Z","title":"Fatemi, B., Halcrow, J., and Perozzi, B","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","snapshot_observed_at":"2026-08-07T12:33:49.086526Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures","version":4},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-07T12:42:38.753358Z"},"links":{"cited_paper":"/paper/2409.15268","citing_paper":"/paper/2505.24069"},"observation_digest":"sha256:2ba4141e53953894645bfd10feb573dbfa21214efaeb2c6f5717f4b7f19c2dd7","observation_id":"bc074de8-e6eb-408b-bfe5-ccef2fb27b58","resolution":{"observed_at":"2026-08-07T12:42:38.753358Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2505.24069","last_updated":"2026-05-30T00:02:27Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T12:33:49.086526Z","submitted_at":"2025-05-29T23:24:53Z","title":"Can LLMs Reason Structurally? Benchmarking via the Lens of Data Structures"},"reference_resolution":{"displayed":9,"state_counts":{"malformed_identifier":3,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":5,"verified_exact":0,"verified_fuzzy":1},"total_outbound_references":9},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 9 of 9 outbound references and 0 inbound Pith citation observations for arXiv:2505.24069."}