{"as_of":"2026-08-08T02:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c215bee757036ae690b0955af61791164576136146c2d43c8e2e0a8c24f5ea31","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":32,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T05:14:47.520785Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-07T05:14:47.520785Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.08446","last_updated":"2025-06-10T04:44:28Z","snapshot_observed_at":"2026-08-07T09:15:20.058485Z","submitted_at":"2025-06-10T04:44:28Z","title":"A Survey on Large Language Models for Mathematical Reasoning","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T05:14:47.520785Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2506.08446"},"observation_digest":"sha256:13eb5b73623c9515c1be4ca4ae246784b22f0ce5b3b3f08aa7d89ca6e56d73e8","observation_id":"ac5546ec-9df7-4b56-ab61-5bdf12648fba","resolution":{"observed_at":"2026-08-07T05:14:47.520785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-06T20:31:47.992493Z","title":"Looped transformers are better at learning learning algorithms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.02754","last_updated":"2025-07-03T16:16:34Z","snapshot_observed_at":"2026-08-06T20:19:29.715939Z","submitted_at":"2025-07-03T16:16:34Z","title":"Fast and Simplex: 2-Simplicial Attention in Triton","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-06T20:31:47.992493Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2507.02754"},"observation_digest":"sha256:5aa63e5f3911d2c21563c8cce621f2d79c51ccf5be2afd97d58c383f9818fc94","observation_id":"7baf9805-b726-47c2-987a-4119f5be4ac3","resolution":{"observed_at":"2026-08-06T20:31:47.992493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-06T18:33:20.499325Z","title":"Looped transformers are better at learning learning algorithms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.07996","last_updated":"2025-07-10T17:59:53Z","snapshot_observed_at":"2026-08-06T18:25:28.097317Z","submitted_at":"2025-07-10T17:59:53Z","title":"Skip a Layer or Loop it? Test-Time Depth Adaptation of Pretrained LLMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T18:33:20.499325Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2507.07996"},"observation_digest":"sha256:bf2ab533d432222bef45b92d3cf782e588dc474c5f16f2fe7916515c6f6c343e","observation_id":"d55f31ec-99ae-4bfe-8207-672fe36795e3","resolution":{"observed_at":"2026-08-06T18:33:20.499325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2508.16745","last_updated":"2026-05-07T14:29:44Z","snapshot_observed_at":"2026-08-02T06:49:37.602255Z","submitted_at":"2025-08-22T18:57:08Z","title":"Beyond Memorization: Extending Reasoning Depth with Recurrence, Memory and Test-Time Compute Scaling","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-18T20:49:26.966293Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2508.16745"},"observation_digest":"sha256:35d5a74b1b74d1070a3f03467e42fbc3d099270e615110b2fd89c51dd7480dad","observation_id":"b9b74d5d-665c-43f4-9b29-319a00aed38e","resolution":{"observed_at":"2026-05-18T20:51:50.783909Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2510.12773","last_updated":"2026-05-18T21:02:06Z","snapshot_observed_at":"2026-08-03T04:39:11.410726Z","submitted_at":"2025-10-14T17:51:26Z","title":"Dr.LLM: Dynamic Layer Routing in LLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T20:01:48.806709Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2510.12773"},"observation_digest":"sha256:82405be78f2d260db98a69f89c713d14bf62591cfe118efbdc305231d8d67aa6","observation_id":"b3344619-5ac2-4f1c-902f-6e11c86e0e45","resolution":{"observed_at":"2026-05-21T20:04:20.322992Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2510.25741","last_updated":"2026-07-01T23:25:58Z","snapshot_observed_at":"2026-08-04T07:30:51.188041Z","submitted_at":"2025-10-29T17:45:42Z","title":"Scaling Latent Reasoning via Looped Language Models","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-15T07:43:11.620446Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2510.25741"},"observation_digest":"sha256:1d5dab5fe03e2ecacdba7aaf2c4315d05ccca486e8aa2536531eff4d84485685","observation_id":"db66b97e-dea3-4dbc-9e00-e7702aea514c","resolution":{"observed_at":"2026-05-15T07:43:11.911968Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-04T07:31:11.348348Z","title":"Looped transformers are better at learning learning algorithms","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2510.25741","last_updated":"2026-07-01T23:25:58Z","snapshot_observed_at":"2026-08-04T07:30:51.188041Z","submitted_at":"2025-10-29T17:45:42Z","title":"Scaling Latent Reasoning via Looped Language Models","version":5},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-04T07:31:11.348348Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2510.25741"},"observation_digest":"sha256:7f359d7d6d353713b53bb7c2ba63ef3f82ffd55b1bfb97853257948b10c93499","observation_id":"d1a238ee-4dfc-455e-8966-3ed5eb746f64","resolution":{"observed_at":"2026-08-04T07:31:11.348348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-03T21:06:30.161963Z","title":"Looped transformers are better at learning learning al- gorithms.arXiv preprint arXiv:2311.12424,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.16886","last_updated":"2026-05-30T04:11:13Z","snapshot_observed_at":"2026-08-07T13:59:49.620528Z","submitted_at":"2025-11-21T01:54:23Z","title":"Latent Reasoning in TRMs is Secretly a Policy Improvement Operator","version":5},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T21:06:30.161963Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2511.16886"},"observation_digest":"sha256:6137f9d963b8bc85ae3806c8ffa0459b3dabb0acbab13124582fef029d499149","observation_id":"f05a28e1-9b46-4a09-90ea-5f15886d9229","resolution":{"observed_at":"2026-08-03T21:06:30.161963Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-07-15T12:09:16.468055Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.09221","last_updated":"2026-05-29T05:28:18Z","snapshot_observed_at":"2026-07-15T12:09:13.856257Z","submitted_at":"2026-03-10T05:42:13Z","title":"Beyond Test-Time Memory: State-Space Optimal Control for LLM Reasoning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-15T12:09:16.468055Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2603.09221"},"observation_digest":"sha256:2f28c0e2ab2a783bd000c340ca30b72213bfa7d7ebbe930f6c5e904ecd897ab8","observation_id":"52f26761-85b8-4931-b7c4-f7990128c0c8","resolution":{"observed_at":"2026-07-15T12:09:16.468055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-10T17:19:22.543462Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:c58a71168a2a60d3ccbf5e9b988a2179e6140e9bcba63b49b39e28fb51d977f7","observation_id":"1a52b37d-f2a8-42a4-90c4-04421df42e89","resolution":{"observed_at":"2026-05-11T07:06:00.069258Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-02T16:35:03.415864Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2604.09168","last_updated":"2026-07-23T07:42:32Z","snapshot_observed_at":"2026-08-06T11:01:30.223629Z","submitted_at":"2026-04-10T09:53:27Z","title":"ELT: Elastic Looped Transformers for Visual Generation","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-02T16:35:03.415864Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.09168"},"observation_digest":"sha256:fe4a701596e2d8effaeacb72936814d2d723311b6d5ccc299c9a89e825c7b8f2","observation_id":"c381031a-4e2b-4f29-9acd-b300de2f44c9","resolution":{"observed_at":"2026-08-02T16:35:03.415864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.11791","last_updated":"2026-04-13T17:55:36Z","snapshot_observed_at":"2026-08-02T14:25:36.633868Z","submitted_at":"2026-04-13T17:55:36Z","title":"A Mechanistic Analysis of Looped Reasoning Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:19.680424Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.11791"},"observation_digest":"sha256:5956237454614916bdc34185a5fa29ded6d0afb337035071638f0a92d3a636ab","observation_id":"31921472-32b9-46a1-bc72-4cf406615250","resolution":{"observed_at":"2026-05-11T09:41:02.876059Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.12946","last_updated":"2026-04-14T16:43:37Z","snapshot_observed_at":"2026-07-06T23:01:05.634599Z","submitted_at":"2026-04-14T16:43:37Z","title":"Parcae: Scaling Laws For Stable Looped Language Models","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-10T15:33:04.442462Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.12946"},"observation_digest":"sha256:2b56fec3674b108d6891b397e904669463dbe15528b885605b72faa881e5fb52","observation_id":"43603986-8bb0-43de-92a8-5773eda409a9","resolution":{"observed_at":"2026-05-11T10:21:01.161581Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.15259","last_updated":"2026-04-22T15:48:32Z","snapshot_observed_at":"2026-07-06T23:02:49.302337Z","submitted_at":"2026-04-16T17:35:49Z","title":"Stability and Generalization in Looped Transformers","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T12:21:16.015362Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.15259"},"observation_digest":"sha256:a72b698377e7e47cc0f65c0fb55ca9ff35ed0b3b71273c2c9e1158a0ccdfed8b","observation_id":"b6054488-d2eb-4ff5-a763-8ef5437f399a","resolution":{"observed_at":"2026-05-10T12:25:22.705878Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.18839","last_updated":"2026-04-20T21:06:12Z","snapshot_observed_at":"2026-07-06T23:05:35.374092Z","submitted_at":"2026-04-20T21:06:12Z","title":"One Step Forward and K Steps Back: Better Reasoning with Denoising Recursion Models","version":1},"reference_index":213,"source":"arxiv_source","source_observed_at":"2026-05-10T04:56:35.796962Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.18839"},"observation_digest":"sha256:7154f04d2c3f35075b7f34b4e7847e7231756e06a94a30f69d89b3a6b62cde13","observation_id":"73035e9e-ba65-4284-ba4c-c9b39f1056e4","resolution":{"observed_at":"2026-05-10T11:05:09.039941Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2604.21254","last_updated":"2026-07-02T01:19:03Z","snapshot_observed_at":"2026-08-06T10:48:44.855597Z","submitted_at":"2026-04-23T03:46:14Z","title":"Hyperloop Transformers","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-09T23:09:35.640412Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2604.21254"},"observation_digest":"sha256:e5bb07943bca01a00ada697887cd8e8e6146c60131def339e84f598d930c6fdc","observation_id":"569ef911-975d-46cf-85e5-a1d0c5f74f1f","resolution":{"observed_at":"2026-05-11T14:16:04.406242Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.07588","last_updated":"2026-05-08T11:02:11Z","snapshot_observed_at":"2026-07-06T23:19:56.415523Z","submitted_at":"2026-05-08T11:02:11Z","title":"Revisiting Transformer Layer Parameterization Through Causal Energy Minimization","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T02:17:32.226166Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.07588"},"observation_digest":"sha256:f3c698d7fd1d276accb86f336b4f54339d631ffca9578aec057a7b71d31b2b53","observation_id":"fe12ed9a-f66f-4efa-9fa8-c276beb8bebe","resolution":{"observed_at":"2026-05-11T03:45:59.117926Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.07721","last_updated":"2026-05-19T08:08:32Z","snapshot_observed_at":"2026-08-02T23:35:32.635346Z","submitted_at":"2026-05-08T13:25:27Z","title":"Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T02:44:36.697450Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.07721"},"observation_digest":"sha256:ce0593b3e9bd0eafd8a35ff98206566e9fcb88a4a5e95b2d87a3a532fc7321bd","observation_id":"e8ddfa5d-10cd-4553-b6d3-1c76b514440d","resolution":{"observed_at":"2026-05-11T02:45:57.716481Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.07721","last_updated":"2026-05-19T08:08:32Z","snapshot_observed_at":"2026-08-02T23:35:32.635346Z","submitted_at":"2026-05-08T13:25:27Z","title":"Memory-Efficient Looped Transformer: Decoupling Compute from Memory in Looped Language Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-20T23:01:17.957634Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.07721"},"observation_digest":"sha256:d262787aaa74d0d05e377be67d9413bc7c3fa63c5af5b69a31000897cb9f8a6b","observation_id":"1c218afb-52a6-4e0b-986e-27ab182ee108","resolution":{"observed_at":"2026-05-20T23:03:50.651160Z","resolver_source":"arxiv_id","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.18797","last_updated":"2026-05-25T04:21:17Z","snapshot_observed_at":"2026-08-02T05:53:57.809613Z","submitted_at":"2026-05-11T07:21:53Z","title":"Simply Stabilizing the Loop via Fully Looped Transformer","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-20T23:19:28.027625Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.18797"},"observation_digest":"sha256:1959170778a02e3d45ee6e08797a143992d418b077a8624283a490ebfebfa395","observation_id":"3551defe-cbb4-421c-814c-4e3073f3fa90","resolution":{"observed_at":"2026-05-20T23:23:51.684336Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.19376","last_updated":"2026-05-20T08:03:28Z","snapshot_observed_at":"2026-08-02T08:01:51.109959Z","submitted_at":"2026-05-19T05:20:56Z","title":"Generative Recursive Reasoning","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-20T05:58:23.543870Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.19376"},"observation_digest":"sha256:c32d7a19b614c4dad3b74c66dd74b339ab8339b4874b9eede24c8a7337b23f29","observation_id":"3b1fd5bd-2445-47b0-839f-b2140b0b7226","resolution":{"observed_at":"2026-05-20T06:03:05.463229Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.19376","last_updated":"2026-05-20T08:03:28Z","snapshot_observed_at":"2026-08-02T08:01:51.109959Z","submitted_at":"2026-05-19T05:20:56Z","title":"Generative Recursive Reasoning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T07:40:30.199868Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.19376"},"observation_digest":"sha256:3d8fced9a5d75ea0a5b878a9cd2db8d2f84acfa3af70dab6482309425b19ff10","observation_id":"8a8dd166-6c65-4af3-9702-5e4eae77798f","resolution":{"observed_at":"2026-05-21T07:44:03.156867Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.26106","last_updated":"2026-05-25T17:58:24Z","snapshot_observed_at":"2026-07-06T23:36:01.564747Z","submitted_at":"2026-05-25T17:58:24Z","title":"Looped Diffusion Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-29T23:13:12.343355Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.26106"},"observation_digest":"sha256:232879e4b41b1b935f58c1331a7a3883c3f01ba8e67aaf1a8ff2c88d976b7b67","observation_id":"a6e68ede-ad75-41ad-b49f-088426e09b66","resolution":{"observed_at":"2026-06-29T23:14:01.184995Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2605.26733","last_updated":"2026-05-26T09:11:12Z","snapshot_observed_at":"2026-08-06T20:28:00.477691Z","submitted_at":"2026-05-26T09:11:12Z","title":"Stabilizing Recurrent Dynamics for Test-Time Scalable Latent Reasoning in Looped Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-29T20:04:32.090919Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2605.26733"},"observation_digest":"sha256:51ee8bd7b287d8bafe4978aec360515101ed4b7f09d0fe456708a639581daf69","observation_id":"9957a063-9204-423c-9b06-2d22fc0f5c8e","resolution":{"observed_at":"2026-07-01T16:55:50.838803Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.06574","last_updated":"2026-06-04T17:59:58Z","snapshot_observed_at":"2026-07-06T23:46:24.981618Z","submitted_at":"2026-06-04T17:59:58Z","title":"Skip a Layer or Loop It? Learning Program-of-Layers in LLMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T01:56:34.435152Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.06574"},"observation_digest":"sha256:c3f015d22b4bce31e43a212f553a91f23459e617599432e61fe36212fd4a1e7e","observation_id":"fd9c3b51-829e-4261-ab83-584983581290","resolution":{"observed_at":"2026-07-02T12:36:57.360001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.06624","last_updated":"2026-06-08T15:12:03Z","snapshot_observed_at":"2026-08-02T09:46:22.331867Z","submitted_at":"2026-06-04T18:21:03Z","title":"Principles and Practice of Deep Representation Learning: or a Mathematical Theory of Memory","version":2},"reference_index":114,"source":"pdf_text","source_observed_at":"2026-06-28T03:07:52.730713Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.06624"},"observation_digest":"sha256:6e2e662dd8215f3e0c77dbe0cad22b831cc196b83f2c2f11894a215408c69dd1","observation_id":"1084b777-ea73-4ac9-9046-56a4404a6605","resolution":{"observed_at":"2026-07-02T11:46:55.246863Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.18022","last_updated":"2026-06-16T15:02:49Z","snapshot_observed_at":"2026-08-02T11:08:23.417300Z","submitted_at":"2026-06-16T15:02:49Z","title":"Recursive Scaling in Masked Diffusion Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-06-27T01:44:05.022187Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.18022"},"observation_digest":"sha256:2833fab3c3bd9f59959ab1b5883d97b6592e8ddc069ba2a4b11d2114599beb0a","observation_id":"43d26cc0-a137-4cff-9282-77c60f3b052c","resolution":{"observed_at":"2026-07-03T19:58:54.919466Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.18208","last_updated":"2026-06-16T17:37:27Z","snapshot_observed_at":"2026-07-06T23:53:40.698123Z","submitted_at":"2026-06-16T17:37:27Z","title":"Looped World Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T01:49:57.105358Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.18208"},"observation_digest":"sha256:8655896cafccecf8ae1ad891e42f900785a65474a9c5082c44b64c45a7f4c7e1","observation_id":"eee62f3c-a5a5-4ef0-92c9-68408c9250b9","resolution":{"observed_at":"2026-07-03T19:28:52.391390Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.18208","last_updated":"2026-06-16T17:37:27Z","snapshot_observed_at":"2026-07-06T23:53:40.698123Z","submitted_at":"2026-06-16T17:37:27Z","title":"Looped World Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-27T01:49:57.105358Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.18208"},"observation_digest":"sha256:e759bd4c9add078bc3caa53afa094ce8d0a335cdb53e6152785c82f80fd78a9e","observation_id":"b15ff817-c0ff-4df8-8d55-fe8c76a7a16c","resolution":{"observed_at":"2026-06-27T01:50:21.199353Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":"2311.12424","doi":"10.48550/arxiv.2311.12424","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424","venue":"arXiv (Cornell University)","work_id":"106dc53d-89b5-4d70-922b-1c41185d4328","year":2023},"citing_paper":{"arxiv_id":"2606.29983","last_updated":"2026-06-29T08:58:09Z","snapshot_observed_at":"2026-08-03T21:27:41.768539Z","submitted_at":"2026-06-29T08:58:09Z","title":"Stabilizing Extrapolation in Looped Transformers via Learned Stochastic Stopping","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T07:29:23.786653Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2606.29983"},"observation_digest":"sha256:88acb1c0c9aa82dfc21b020eece3a294dc31de459010493f2c63a070870e073b","observation_id":"9a756ddc-2c12-40c6-abf3-478c746104a7","resolution":{"observed_at":"2026-06-30T07:34:20.928414Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-02T08:13:30.565694Z","title":"Eric Zelikman, Georges Harik, Yijia Shao, Varuna Jayasiri, Nick Haber, and Noah D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20519","last_updated":"2026-07-08T02:54:03Z","snapshot_observed_at":"2026-08-06T23:41:10.107122Z","submitted_at":"2026-07-08T02:54:03Z","title":"Adaptive Depth in Looped Transformers: Diagnosing Learned Halting Gates and Trajectory Readouts","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-02T08:13:30.565694Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2607.20519"},"observation_digest":"sha256:84169b3e20032debe8e60d34c0276a4111364aafc4559a45c73bd357d02c44ad","observation_id":"ee72711e-bd43-474d-b726-73b7fc11920f","resolution":{"observed_at":"2026-08-02T08:13:30.565694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12424","snapshot_observed_at":"2026-08-01T10:14:11.657461Z","title":"Looped transformers are better at learning learning algorithms.arXiv preprint arXiv:2311.12424,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20594","last_updated":"2026-07-22T16:04:31Z","snapshot_observed_at":"2026-08-07T01:30:36.940347Z","submitted_at":"2026-07-22T16:04:31Z","title":"When Does Recurrence Become an Algorithm? Convergence Selection in Weight-Tied Looped Transformers","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-01T10:14:11.657461Z"},"links":{"cited_paper":"/paper/2311.12424","citing_paper":"/paper/2607.20594"},"observation_digest":"sha256:a0be9151acc9595ff4097f679fd67d791639a4bc39072327b9ac8b7458c5dfe5","observation_id":"41107749-7689-400b-b356-323262ca2c0b","resolution":{"observed_at":"2026-08-01T10:14:11.657461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2311.12424/citation-record","integrity":"/paper/2311.12424/integrity","json":"/paper/2311.12424/citation-record.json","paper":"/paper/2311.12424"},"outbound":[],"paper":{"arxiv_id":"2311.12424","last_updated":"2024-03-16T21:10:38Z","latest_version":3,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T16:50:26.807430Z","submitted_at":"2023-11-21T08:32:38Z","title":"Looped Transformers are Better at Learning Learning Algorithms"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 32 inbound Pith citation observations for arXiv:2311.12424."}