{"as_of":"2026-08-09T02:50:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:9dbabcf917f71ac498129729beb56195d281371c81271fef4e14615a3513b021","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":22,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:25:16.820859Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":45,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2402.17762","last_updated":"2024-08-14T16:00:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-02-27T18:55:17Z","title":"Massive Activations in Large Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-16T07:02:53.740597Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2402.17762"},"observation_digest":"sha256:99d424cf1482f9859c7f2e607c58ac53fea66c0c00f73e34643b71885a02e317","observation_id":"9587bdfb-4457-41ac-a217-9877c405cf5a","resolution":{"observed_at":"2026-05-16T07:02:53.839680Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-08T20:25:16.820859Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05252","last_updated":"2025-02-07T17:05:25Z","snapshot_observed_at":"2026-08-09T01:20:28.151253Z","submitted_at":"2025-02-07T17:05:25Z","title":"GSM-Infinite: How Do Your LLMs Behave over Infinitely Increasing Context Length and Reasoning Complexity?","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T20:25:16.820859Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2502.05252"},"observation_digest":"sha256:c9ed7151eda425c137f65bf28d1d751ff51a72e4c6b59ea800131219670c3a9c","observation_id":"cc7a17b9-e075-4884-95d5-0a71615f0d35","resolution":{"observed_at":"2026-08-08T20:25:16.820859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-07T18:32:14.589213Z","title":"K., Catt, E., Cundy, C., Hutter, M., Legg, S., Veness, J., and Ortega, P","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.10390","last_updated":"2025-07-08T18:20:16Z","snapshot_observed_at":"2026-08-08T23:23:47.910559Z","submitted_at":"2025-02-14T18:59:40Z","title":"(How) Can Transformers Predict Pseudo-Random Numbers?","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T18:32:14.589213Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2502.10390"},"observation_digest":"sha256:7d2ee8376160af74f82b3cab73ec9f9284fdb96b052eb53e2d919f3895a70418","observation_id":"9a754838-2723-4bb3-ba5a-0c787cd333e3","resolution":{"observed_at":"2026-08-07T18:32:14.589213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-07T15:42:28.200668Z","title":"arXiv preprint arXiv:2207.02098","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14178","last_updated":"2025-05-20T10:32:30Z","snapshot_observed_at":"2026-08-08T23:25:27.533968Z","submitted_at":"2025-05-20T10:32:30Z","title":"Tokenization Constraints in LLMs: A Study of Symbolic and Arithmetic Reasoning Limits","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-07T15:42:28.200668Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2505.14178"},"observation_digest":"sha256:5c254184177ae758bf25482656c2ddab9674f0930d846d1412ec3b88bcf1c749","observation_id":"2ae0fda0-8c58-48b0-9b04-203c46098115","resolution":{"observed_at":"2026-08-07T15:42:28.200668Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-07T13:52:57.660079Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.21024","last_updated":"2025-05-27T10:59:27Z","snapshot_observed_at":"2026-08-08T23:24:40.031957Z","submitted_at":"2025-05-27T10:59:27Z","title":"Pause Tokens Strictly Increase the Expressivity of Constant-Depth Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T13:52:57.660079Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2505.21024"},"observation_digest":"sha256:887b257b40e1bb6b390454a5d9dd21d6b907cf17618c40f1117ac0c303ff1445","observation_id":"fba3e2d5-644a-4db5-ae8a-b74125ce4d24","resolution":{"observed_at":"2026-08-07T13:52:57.660079Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-06T15:54:33.911739Z","title":"Neural networks and the chomsky hierarchy","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.14777","last_updated":"2025-07-20T00:33:19Z","snapshot_observed_at":"2026-08-06T15:45:37.558605Z","submitted_at":"2025-07-20T00:33:19Z","title":"Rethinking Memorization Measures and their Implications in Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:54:33.911739Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2507.14777"},"observation_digest":"sha256:27f32137551a275533b8f9911c51d5749af92f6cee05232f1fef174ab7975d41","observation_id":"329e5830-fad8-4f8b-95a5-1353a9b0c8d9","resolution":{"observed_at":"2026-08-06T15:54:33.911739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2602.01651","last_updated":"2026-04-21T07:48:12Z","snapshot_observed_at":"2026-07-06T22:44:04.951815Z","submitted_at":"2026-02-02T05:11:48Z","title":"On the Spatiotemporal Dynamics of Generalization in Neural Networks","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T08:59:44.016444Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2602.01651"},"observation_digest":"sha256:d4a685f5ac43bc96f74e7eb3d1e25dd22c4a2ef4279958d75ca1bf4cdf6cd7ae","observation_id":"06718ac3-ac32-4447-8052-ddd5fcdbb80d","resolution":{"observed_at":"2026-05-16T09:00:46.926324Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2602.01651","last_updated":"2026-04-21T07:48:12Z","snapshot_observed_at":"2026-07-06T22:44:04.951815Z","submitted_at":"2026-02-02T05:11:48Z","title":"On the Spatiotemporal Dynamics of Generalization in Neural Networks","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-16T08:59:44.016444Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2602.01651"},"observation_digest":"sha256:963ff2c3f883204835eaa3774f8075c028e782d08dffa2cede97e671774325d5","observation_id":"d8c92058-80df-4b09-89fa-f9243a9b5e3c","resolution":{"observed_at":"2026-05-16T09:00:46.842573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2602.14814","last_updated":"2026-06-25T13:57:14Z","snapshot_observed_at":"2026-08-03T04:41:03.080168Z","submitted_at":"2026-02-16T15:07:51Z","title":"Learning State-Tracking from Code Using Linear RNNs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T21:46:14.287966Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2602.14814"},"observation_digest":"sha256:89db522090c0ea13d4575bf368d54af0790e27b44ced27aa2028e36ace4676d7","observation_id":"1f4b19a2-3595-4ff4-8700-8485d6bd1af2","resolution":{"observed_at":"2026-05-15T21:46:42.396411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-02T23:07:48.383042Z","title":"Neural networks and the chomsky hierarchy.arXiv preprint arXiv:2207.02098,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.14814","last_updated":"2026-06-25T13:57:14Z","snapshot_observed_at":"2026-08-03T04:41:03.080168Z","submitted_at":"2026-02-16T15:07:51Z","title":"Learning State-Tracking from Code Using Linear RNNs","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-02T23:07:48.383042Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2602.14814"},"observation_digest":"sha256:abb8fb01dcc7d92015066397af0ffddf91610cad13c1b0fe5eadf42f50f47509","observation_id":"55b3aac6-e2e2-484a-82a6-302fff22421c","resolution":{"observed_at":"2026-08-02T23:07:48.383042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2603.29069","last_updated":"2026-04-05T18:40:06Z","snapshot_observed_at":"2026-08-07T17:56:32.986328Z","submitted_at":"2026-03-30T23:15:21Z","title":"On the Mirage of Long-Range Dependency, with an Application to Integer Multiplication","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-14T21:07:37.032208Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2603.29069"},"observation_digest":"sha256:9f16c43a9d6d2e4f4529e5580f136ff1b146b1d7dcea8cb1955608c6ca36934b","observation_id":"20396610-611d-4af0-a19f-af52bf915311","resolution":{"observed_at":"2026-05-14T21:09:28.840810Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2603.29069","last_updated":"2026-04-05T18:40:06Z","snapshot_observed_at":"2026-08-07T17:56:32.986328Z","submitted_at":"2026-03-30T23:15:21Z","title":"On the Mirage of Long-Range Dependency, with an Application to Integer Multiplication","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-14T21:07:37.032208Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2603.29069"},"observation_digest":"sha256:7ea8ee38bf2fa200cf74821654da961ef9028e0cd0b5f8e6daa85b9c055fb724","observation_id":"10ba4387-91fc-4f01-bb13-f929f5e69e90","resolution":{"observed_at":"2026-05-14T21:07:57.561296Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2604.02709","last_updated":"2026-04-15T09:12:39Z","snapshot_observed_at":"2026-07-06T22:52:02.162758Z","submitted_at":"2026-04-03T04:06:39Z","title":"Evaluating the Formal Reasoning Capabilities of Large Language Models through Chomsky Hierarchy","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-13T19:51:08.304741Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2604.02709"},"observation_digest":"sha256:e917362c60545455861f34d650155e3862ee2bb430b31eb1cc372a4f5c50061a","observation_id":"77495dcc-7142-4e6f-8538-26e47c84272e","resolution":{"observed_at":"2026-05-13T19:53:11.720559Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2604.05923","last_updated":"2026-04-07T14:23:40Z","snapshot_observed_at":"2026-08-04T01:48:44.289003Z","submitted_at":"2026-04-07T14:23:40Z","title":"The UNDO Flip-Flop: A Controlled Probe for Reversible Semantic State Management in State Space Model","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T18:45:35.405345Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2604.05923"},"observation_digest":"sha256:7b94209d7027a255b7591694aee87467073a40fc252f611a5530ac9b8de00ed5","observation_id":"d6b88308-941f-4524-ba35-e3d20bc1e7a3","resolution":{"observed_at":"2026-05-11T00:00:52.685816Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2604.17857","last_updated":"2026-04-21T13:11:34Z","snapshot_observed_at":"2026-07-06T23:04:50.935335Z","submitted_at":"2026-04-20T06:10:50Z","title":"On the Emergence of Syntax by Means of Local Interaction","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-10T04:16:41.473079Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2604.17857"},"observation_digest":"sha256:3302e13ef2ca97d9155b02d52f43ace70128451397116a845b549036dd263cf2","observation_id":"72b419aa-a2d4-4bb5-88a1-35e9e472be13","resolution":{"observed_at":"2026-05-11T12:06:01.188483Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2604.17857","last_updated":"2026-04-21T13:11:34Z","snapshot_observed_at":"2026-07-06T23:04:50.935335Z","submitted_at":"2026-04-20T06:10:50Z","title":"On the Emergence of Syntax by Means of Local Interaction","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-10T04:16:41.473079Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2604.17857"},"observation_digest":"sha256:798f07ba117356447592044838d9d07edc3d9012353f0aa35f95db170b44a93c","observation_id":"67cbd6e7-d1cd-4808-8b23-38c9eb27eb6d","resolution":{"observed_at":"2026-05-10T04:20:03.855745Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2605.05209","last_updated":"2026-07-26T22:32:59Z","snapshot_observed_at":"2026-08-02T17:39:23.922835Z","submitted_at":"2026-03-24T06:14:05Z","title":"Are Flat Minima an Illusion?","version":1},"reference_index":158,"source":"arxiv_source","source_observed_at":"2026-05-15T01:13:22.708879Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2605.05209"},"observation_digest":"sha256:8998fc3a9585f57a60605057c3c037c44a992cc84c7334d9572058e7984bd047","observation_id":"3d641c26-44ee-461d-ace5-56ec90d59821","resolution":{"observed_at":"2026-05-15T01:13:25.571490Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2605.21070","last_updated":"2026-05-20T11:56:15Z","snapshot_observed_at":"2026-07-06T23:31:32.577242Z","submitted_at":"2026-05-20T11:56:15Z","title":"Towards Understanding Self-Pretraining for Sequence Classification","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-21T05:29:58.809024Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2605.21070"},"observation_digest":"sha256:e71cc8a80e037ba3df5be3d61bd6aa8cf547d5d48c39ccfe42a031d513935958","observation_id":"03d7fee1-fb6d-4723-9779-457208bf9df0","resolution":{"observed_at":"2026-05-21T05:33:58.277977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":"2207.02098","doi":"10.48550/arxiv.2207.02098","metadata_source":"arxiv_reference","pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"International Conference on Learning Representations , month =","venue":"arXiv (Cornell University)","work_id":"1b7f8055-2e20-4d37-b9ab-1748c03c4a1c","year":2023},"citing_paper":{"arxiv_id":"2606.21884","last_updated":"2026-06-20T04:52:14Z","snapshot_observed_at":"2026-08-03T01:34:19.883808Z","submitted_at":"2026-06-20T04:52:14Z","title":"A Verifiable Search Is Not a Learnable Chain-of-Thought","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-26T12:35:20.698118Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2606.21884"},"observation_digest":"sha256:79f160687a92400b1a6c9ce021e7975e35eee4187a5eda2195fbdebf7d027e12","observation_id":"aa4c173d-c551-495f-b31a-cd5e858cc075","resolution":{"observed_at":"2026-07-04T07:49:39.740648Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T07:53:24.12734+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-02T07:20:41.199053Z","title":"Del\\'etang, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.11953","last_updated":"2026-07-15T13:05:53Z","snapshot_observed_at":"2026-08-08T05:16:44.265065Z","submitted_at":"2026-07-11T21:33:32Z","title":"When Does Reward Teach State? A Hidden-Automaton Instrument and the Group-Language Boundary","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T07:20:41.199053Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2607.11953"},"observation_digest":"sha256:0e0f3a39cb19c45e8a39276755d3beb4434fb81c7016c6427dc10d202752e12c","observation_id":"3ec6d875-a65b-4b1b-ab40-7243740a6c55","resolution":{"observed_at":"2026-08-02T07:20:41.199053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-06T00:43:14.297280Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.00981","last_updated":"2026-08-02T04:15:12Z","snapshot_observed_at":"2026-08-08T23:24:38.455242Z","submitted_at":"2026-08-02T04:15:12Z","title":"Auditing Discovery Claims: A Two-Sided Criterion for Agentic Science, with the Negative Side Decidable","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T00:43:14.297280Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2608.00981"},"observation_digest":"sha256:ccc6639f7d822119cb66348eefb224dc124f9b540ad7e5d621adffb8341bcd2b","observation_id":"b0bd34aa-0379-4d8c-b17f-884719b758cf","resolution":{"observed_at":"2026-08-06T00:43:14.297280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.02098","snapshot_observed_at":"2026-08-06T00:53:43.296195Z","title":"arXiv , arxivId =:2207.02098 , journal =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01005","last_updated":"2026-08-02T05:22:30Z","snapshot_observed_at":"2026-08-08T01:27:54.317708Z","submitted_at":"2026-08-02T05:22:30Z","title":"Hierarchical Solomonoff Induction: An Unbounded Machine Learning Model","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-06T00:53:43.296195Z"},"links":{"cited_paper":"/paper/2207.02098","citing_paper":"/paper/2608.01005"},"observation_digest":"sha256:8020c6afcfb8568b44907d7e72231c5a53f2b0c5e794ea8cfd00bf329bff7ff0","observation_id":"5c23beb0-9782-4913-90ed-9b1e19e59119","resolution":{"observed_at":"2026-08-06T00:53:43.296195Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2207.02098/citation-record","integrity":"/paper/2207.02098/integrity","json":"/paper/2207.02098/citation-record.json","paper":"/paper/2207.02098"},"outbound":[],"paper":{"arxiv_id":"2207.02098","last_updated":"2023-02-28T13:22:17Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T23:24:14.529963Z","submitted_at":"2022-07-05T15:06:11Z","title":"Neural Networks and the Chomsky Hierarchy"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 22 inbound Pith citation observations for arXiv:2207.02098."}