{"as_of":"2026-08-07T16:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7fc85d4ed1bd9d345b326e55a1b866833808f2c04bb18019b6a729c73f026923","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":33,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":33,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":33,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":33,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:36:58.718951Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:29:51.946645Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2211.09085","last_updated":"2022-11-16T18:06:33Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-11-16T18:06:33Z","title":"Galactica: A Large Language Model for Science","version":1},"reference_index":143,"source":"arxiv_source","source_observed_at":"2026-05-13T05:53:21.810346Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2211.09085"},"observation_digest":"sha256:8b4c5c1a7442a401ab1ea9df9b1f58131d34c457695c82b6016ebb283c80e7ee","observation_id":"b0a65376-1db3-45be-add0-577f8291968a","resolution":{"observed_at":"2026-05-13T05:53:22.092110Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-07T15:36:58.718951Z","title":"Banino, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T15:31:28.632451Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:58.718951Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:51c03bcdf486aca740eba4bdc5291b1eafd31a84818ee10f482ed817c054a1c5","observation_id":"873463b9-15c2-4b66-95bc-6faf0e095f12","resolution":{"observed_at":"2026-08-07T15:36:58.718951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2506.21734","last_updated":"2025-08-04T08:45:08Z","snapshot_observed_at":"2026-08-06T13:55:12.607273Z","submitted_at":"2025-06-26T19:39:54Z","title":"Hierarchical Reasoning Model","version":3},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-15T04:58:03.283911Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2506.21734"},"observation_digest":"sha256:5e374cb7268782f19425cd6f911faf9d1e7323d6476e6eca29b2178fd76a0082","observation_id":"4ef5ec52-c796-4d86-a821-abc1cf535f9e","resolution":{"observed_at":"2026-05-15T04:58:03.580048Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-06T16:28:21.342403Z","title":"Pondernet: Learning to ponder","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.13569","last_updated":"2025-07-17T23:12:57Z","snapshot_observed_at":"2026-08-06T16:19:29.090201Z","submitted_at":"2025-07-17T23:12:57Z","title":"Change of Thought: Adaptive Test-Time Computation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T16:28:21.342403Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2507.13569"},"observation_digest":"sha256:28652d977b91573c9099cfb82f12629f5207c58863b81a91e5b24936c59ef653","observation_id":"28faae89-997c-459c-845b-6edb9bfc1cd1","resolution":{"observed_at":"2026-08-06T16:28:21.342403Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-05T15:51:47.015805Z","title":"Pondernet: Learning to ponder","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.00079","last_updated":"2025-08-26T22:29:12Z","snapshot_observed_at":"2026-08-05T15:51:46.752702Z","submitted_at":"2025-08-26T22:29:12Z","title":"Entropy-Guided Loop: Achieving Reasoning through Uncertainty-Aware Generation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-05T15:51:47.015805Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2509.00079"},"observation_digest":"sha256:9d29a5703043ca02d8b1a055de06ef785b757d6b389fb6dc644792031f1400bc","observation_id":"8907baea-6128-4e85-a2b4-14496ca93a97","resolution":{"observed_at":"2026-08-05T15:51:47.015805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2510.25741","last_updated":"2026-07-01T23:25:58Z","snapshot_observed_at":"2026-08-04T07:30:51.188041Z","submitted_at":"2025-10-29T17:45:42Z","title":"Scaling Latent Reasoning via Looped Language Models","version":4},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-15T07:43:11.620446Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2510.25741"},"observation_digest":"sha256:fe32813b2ad868dfb5480a3b839beab58dc82e2a5816f0993b9a5d35c63ccac0","observation_id":"68e0663d-52d8-4efc-929e-76cd6a20fd10","resolution":{"observed_at":"2026-05-15T07:43:11.827778Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-04T07:31:30.750415Z","title":"Pondernet: Learning to ponder","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2510.25741","last_updated":"2026-07-01T23:25:58Z","snapshot_observed_at":"2026-08-04T07:30:51.188041Z","submitted_at":"2025-10-29T17:45:42Z","title":"Scaling Latent Reasoning via Looped Language Models","version":5},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-04T07:31:30.750415Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2510.25741"},"observation_digest":"sha256:8a5e4ef3534e891fa477fc67df22165d61b498bad9860546fc66d90e4f8b18cd","observation_id":"328776b6-ba07-44b7-a147-e75583af4e75","resolution":{"observed_at":"2026-08-04T07:31:30.750415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2602.13215","last_updated":"2026-05-13T00:21:04Z","snapshot_observed_at":"2026-08-04T18:17:18.213282Z","submitted_at":"2026-01-22T17:19:58Z","title":"When to Think Fast and Slow? AMOR: Adaptive Entropy Gate for Hybrid Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T11:48:50.587732Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2602.13215"},"observation_digest":"sha256:2fb62b6791a06f2f4bc1bcc25d3bb8f7057e66dde4d25dc882fe9811ffc46b1e","observation_id":"5554fabb-e80d-4a4a-866a-e994eee42072","resolution":{"observed_at":"2026-05-16T11:50:52.806057Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-02T22:08:40.003709Z","title":"Biran, E., Gottesman, D., Yang, S., Geva, M., and Glober- son, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.17993","last_updated":"2026-07-12T00:58:22Z","snapshot_observed_at":"2026-08-07T11:22:28.223283Z","submitted_at":"2026-02-20T05:01:32Z","title":"Turbo Connection: Reasoning as Information Flow from Higher to Lower Layers","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T22:08:40.003709Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2602.17993"},"observation_digest":"sha256:847adc6c700605e6becd81998219941ff2cf2d7abe23595cf896b60b462c6fa5","observation_id":"acae3efc-05c2-4541-a175-4ab47fdcf76f","resolution":{"observed_at":"2026-08-02T22:08:40.003709Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-02T17:37:48.807916Z","title":"Pondernet: Learning to ponder,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2603.23206","last_updated":"2026-07-15T10:05:06Z","snapshot_observed_at":"2026-08-02T17:37:37.525476Z","submitted_at":"2026-03-24T13:52:03Z","title":"Latency Coding for Efficient and Low-Latency Deep Spiking Neural Networks","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-02T17:37:48.807916Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2603.23206"},"observation_digest":"sha256:0e9fc74ea48d6ca6bfd5e9491437fcf95fd014932b0c473d64dd9549e8dd7442","observation_id":"0f86e9a5-1012-44ae-9e82-819996469472","resolution":{"observed_at":"2026-08-02T17:37:48.807916Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2604.11791","last_updated":"2026-04-13T17:55:36Z","snapshot_observed_at":"2026-08-02T14:25:36.633868Z","submitted_at":"2026-04-13T17:55:36Z","title":"A Mechanistic Analysis of Looped Reasoning Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T15:53:19.680424Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2604.11791"},"observation_digest":"sha256:1ae3d60c068a310f1be917059d33a361c95f98d434224cfeef39c7b2710f79b1","observation_id":"25990763-3324-4904-ad94-e6ef127ac48e","resolution":{"observed_at":"2026-05-11T09:41:02.964220Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2604.15259","last_updated":"2026-04-22T15:48:32Z","snapshot_observed_at":"2026-07-06T23:02:49.302337Z","submitted_at":"2026-04-16T17:35:49Z","title":"Stability and Generalization in Looped Transformers","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T12:21:16.015362Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2604.15259"},"observation_digest":"sha256:4fb594745b300c94076d8827d544277ae10a59def24c1c8d3b765657276c2439","observation_id":"088e9859-6dbc-4248-845f-9460699a5f47","resolution":{"observed_at":"2026-05-10T12:25:22.713876Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2604.21999","last_updated":"2026-05-03T23:45:19Z","snapshot_observed_at":"2026-07-06T23:08:28.444591Z","submitted_at":"2026-04-23T18:30:01Z","title":"Universal Transformers Need Memory: Depth-State Trade-offs in Adaptive Recursive Reasoning","version":3},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-09T22:48:07.828512Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2604.21999"},"observation_digest":"sha256:73273c9f6ee767526c051abd3ddd6612598785628b1d60dc6197644889ae997a","observation_id":"5ce1d9a2-e2d7-4654-b268-acae743591d1","resolution":{"observed_at":"2026-05-09T22:49:15.475793Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2604.22110","last_updated":"2026-04-23T23:06:48Z","snapshot_observed_at":"2026-08-03T03:45:15.450142Z","submitted_at":"2026-04-23T23:06:48Z","title":"Do Not Imitate, Reinforce: Iterative Classification via Belief Refinement","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-09T21:48:15.641442Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2604.22110"},"observation_digest":"sha256:812b9282d5fda763a41bb393f434199c01ca5d2a1347a7e09f4c9f8719e402dc","observation_id":"f7f2d05a-15d5-496e-aa78-32b8c324393e","resolution":{"observed_at":"2026-05-11T14:26:04.362989Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2604.25299","last_updated":"2026-04-28T07:09:18Z","snapshot_observed_at":"2026-07-06T23:11:11.827339Z","submitted_at":"2026-04-28T07:09:18Z","title":"The Thinking Pixel: Recursive Sparse Reasoning in Multimodal Diffusion Latents","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-07T17:16:00.988125Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2604.25299"},"observation_digest":"sha256:4194eb09075566cc6e14fee1d5990bfe74a638c2bd6e33824cdc30d7ad0e26b9","observation_id":"33be4c06-488e-4721-867c-cc1efff80454","resolution":{"observed_at":"2026-05-11T23:21:23.336400Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2605.23872","last_updated":"2026-05-22T17:31:16Z","snapshot_observed_at":"2026-07-06T23:33:59.210165Z","submitted_at":"2026-05-22T17:31:16Z","title":"Training-Free Looped Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-25T04:36:10.278337Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2605.23872"},"observation_digest":"sha256:4bddcd70f62c111b92a81e63f3137f66562ad3274a565b7fbd845cd0b4140f5d","observation_id":"f05a5ecc-b432-44cd-9c9b-2d87aec7c7fe","resolution":{"observed_at":"2026-05-25T04:36:36.841157Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2605.27696","last_updated":"2026-05-28T13:12:21Z","snapshot_observed_at":"2026-07-06T23:37:21.716437Z","submitted_at":"2026-05-26T21:16:04Z","title":"Structure over Pixels: Learning Variable-Length Visual Programs","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-29T18:06:01.684713Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2605.27696"},"observation_digest":"sha256:1a4600dc0a2323abc6da184d3aa01debe121f9c0923ea56cba8c43e66150d55d","observation_id":"baff77aa-e468-4d2f-91cb-67379a675413","resolution":{"observed_at":"2026-06-29T18:13:49.003549Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2605.28919","last_updated":"2026-05-27T17:59:14Z","snapshot_observed_at":"2026-08-02T14:41:29.212060Z","submitted_at":"2026-05-27T17:59:14Z","title":"CosmicFish-HRM: Adaptive Reasoning via Hierarchical Recurrent Mechanisms in Compact Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T14:03:33.179735Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2605.28919"},"observation_digest":"sha256:4826f120866304d81bb73d88401dc3eae2ef0de03c8f06d5cb829636f6c0c3cd","observation_id":"ae092dc1-3ac1-45e5-83ac-b74b10a1e2a4","resolution":{"observed_at":"2026-06-29T14:13:30.440137Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2605.30202","last_updated":"2026-05-28T16:41:36Z","snapshot_observed_at":"2026-08-02T20:45:03.599592Z","submitted_at":"2026-05-28T16:41:36Z","title":"A Dual-Path Architecture for Scaling Compute and Capacity in LLMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-29T07:42:07.969657Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2605.30202"},"observation_digest":"sha256:3160802e3a31e55de1cd8ca899c88b0e1e520275c89d862c300ba7580fc962e2","observation_id":"22febac3-1908-4045-8fd9-f0a63a7b7765","resolution":{"observed_at":"2026-06-29T07:43:13.335089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2606.18206","last_updated":"2026-06-16T17:36:33Z","snapshot_observed_at":"2026-08-02T16:48:27.851712Z","submitted_at":"2026-06-16T17:36:33Z","title":"Fixed-Point Reasoners: Stable and Adaptive Deep Looped Transformers","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T00:38:47.350106Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2606.18206"},"observation_digest":"sha256:1fca69ebc9ebecd7377a95aef88e73ca585a5d4bd1bfa84a2db4a4350ebc321e","observation_id":"2f4827eb-d725-466c-a3fe-4dac96167201","resolution":{"observed_at":"2026-07-03T21:18:59.675977Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2606.24898","last_updated":"2026-06-12T13:23:18Z","snapshot_observed_at":"2026-07-06T23:59:23.407216Z","submitted_at":"2026-06-12T13:23:18Z","title":"Dense Supervision Is Not Enough: The Readout Blind Spot in Looped Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-27T04:27:48.590008Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2606.24898"},"observation_digest":"sha256:e6cddc1a4100b5474e07501bc4dee3e5128c00e89e4ae63dfc5cd27f844735d2","observation_id":"3bd5e717-bd0f-4ca0-a793-25e3dd7c52c6","resolution":{"observed_at":"2026-07-03T17:08:44.019617Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2606.26463","last_updated":"2026-06-27T05:05:34Z","snapshot_observed_at":"2026-08-03T01:41:10.487866Z","submitted_at":"2026-06-24T23:55:15Z","title":"Finding the Time to Think: Learning Planning Budgets in Real-Time RL","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-26T05:08:19.504454Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2606.26463"},"observation_digest":"sha256:51cd0d701f1b49d74b5df0bf6d496b080829f3e3eea7889290b268828c367e51","observation_id":"6080d74c-c9cf-4753-a7d6-f9069da12229","resolution":{"observed_at":"2026-07-04T13:29:51.947958Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2606.26463","last_updated":"2026-06-27T05:05:34Z","snapshot_observed_at":"2026-08-03T01:41:10.487866Z","submitted_at":"2026-06-24T23:55:15Z","title":"Finding the Time to Think: Learning Planning Budgets in Real-Time RL","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T09:26:31.944405Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2606.26463"},"observation_digest":"sha256:921db3f1e9b08adfc696911c78639bf19db2380def7e001cf810a7b8c35ad981","observation_id":"2d8fcb70-f5d9-4724-a4cf-4aa4da19b283","resolution":{"observed_at":"2026-06-30T09:34:34.911068Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2606.29983","last_updated":"2026-06-29T08:58:09Z","snapshot_observed_at":"2026-08-03T21:27:41.768539Z","submitted_at":"2026-06-29T08:58:09Z","title":"Stabilizing Extrapolation in Looped Transformers via Learned Stochastic Stopping","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T07:29:23.786653Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2606.29983"},"observation_digest":"sha256:29767182f206286c02cc7fd5e8a79a56f2368b99dec7067b7e18e0f980f5be7f","observation_id":"f7fb284b-b29f-48f0-8c16-b0d431e80993","resolution":{"observed_at":"2026-06-30T07:34:21.643236Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":"2107.05407","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-04T13:29:51.946645Z","title":"Pondernet: Learning to ponder.CoRR, abs/2107.05407","venue":null,"work_id":"dbab54b9-3aa6-4f4d-8117-aa3c5ff6a0fd","year":2021},"citing_paper":{"arxiv_id":"2606.31859","last_updated":"2026-06-30T15:53:27Z","snapshot_observed_at":"2026-08-06T09:39:23.967967Z","submitted_at":"2026-06-30T15:53:27Z","title":"Review Residuals: Update-Conditioned Residual Gating for Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-01T06:38:06.546686Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2606.31859"},"observation_digest":"sha256:399edc5a02b39466e74bd03d1cad50e4de46e9cb798215992efa86ed2b595058","observation_id":"d7e32033-9e93-4cb3-a156-1c7dc98077ef","resolution":{"observed_at":"2026-07-01T06:45:29.839720Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-11T09:35:44.381743Z","title":"Pondernet: Learning to ponder,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.05051","last_updated":"2026-07-06T13:25:33Z","snapshot_observed_at":"2026-08-06T16:22:46.672614Z","submitted_at":"2026-07-06T13:25:33Z","title":"Listen, Think, Transcribe: Continuous Latent Test-Time Scaling for ASR","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-11T09:35:44.381743Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2607.05051"},"observation_digest":"sha256:dcb29f2050baaaacfa3d254ce99eac3143d563be04b26ed2e393731ddc18a846","observation_id":"61dbaa89-ca62-40c4-9e8f-bea2c5954bb6","resolution":{"observed_at":"2026-07-11T09:35:44.381743Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-02T07:23:44.617504Z","title":"PonderNet : Learning to ponder","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.10203","last_updated":"2026-07-18T16:02:20Z","snapshot_observed_at":"2026-08-07T05:51:24.094872Z","submitted_at":"2026-07-11T08:27:33Z","title":"Adaptive Compute in Latent World Models: When Depth Helps, Hurts, or Doesn't Matter","version":3},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T07:23:44.617504Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2607.10203"},"observation_digest":"sha256:c068effe283ede661deb3f162eba244bb8b3e3d3fb0779246355722728f63391","observation_id":"510c67af-104e-4bfc-9844-452230aa1760","resolution":{"observed_at":"2026-08-02T07:23:44.617504Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-07-14T06:57:31.514910Z","title":"PonderNet: Learning to ponder.arXiv preprint arXiv:2107.05407, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.11116","last_updated":"2026-07-13T05:45:35Z","snapshot_observed_at":"2026-07-16T23:19:12.573935Z","submitted_at":"2026-07-13T05:45:35Z","title":"The Equilibrium Is the Initialization: Lazy Identity Collapse in Physics-Structured Deep Equilibrium Reasoning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T06:57:31.514910Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2607.11116"},"observation_digest":"sha256:cdd27afc01572fe2431c5d13b99d9451474cc0565c0107da84a8f761abd8f846","observation_id":"b6f7a5b9-75b6-4985-8d5c-754b090c43a7","resolution":{"observed_at":"2026-07-14T06:57:31.514910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-02T05:05:24.981055Z","title":"Pondernet: Learning to ponder.arXiv preprint arXiv:2107.05407,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13491","last_updated":"2026-07-15T06:37:05Z","snapshot_observed_at":"2026-08-06T10:33:55.264647Z","submitted_at":"2026-07-15T06:37:05Z","title":"DeepLoop: Depth Scaling for Looped Transformers","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T05:05:24.981055Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2607.13491"},"observation_digest":"sha256:a95271ff5b3b0d62d43fd74e97b7dedc2188e6db443157dd0945cd64b3c54a09","observation_id":"9a32a304-b21d-4a35-afbe-ab95480ae931","resolution":{"observed_at":"2026-08-02T05:05:24.981055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-02T02:11:13.947284Z","title":"PonderNet: Learning to ponder.arXiv preprint arXiv:2107.05407, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.14427","last_updated":"2026-07-15T23:38:44Z","snapshot_observed_at":"2026-08-06T08:11:54.028155Z","submitted_at":"2026-07-15T23:38:44Z","title":"Per-Token Fixed-Point Convergence in Depth-Recurrent Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-02T02:11:13.947284Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2607.14427"},"observation_digest":"sha256:314d1231356d728cf5e316ac23868a5cfc0c701a60412679c043fc8cbbbf5e5b","observation_id":"d4575402-d871-496d-a3e7-56479f56c5e5","resolution":{"observed_at":"2026-08-02T02:11:13.947284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-02T08:13:27.955279Z","title":"Mar Gonzàlez I Català, Haitz Sáez de Ocáriz Borde, George D","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20519","last_updated":"2026-07-08T02:54:03Z","snapshot_observed_at":"2026-08-06T23:41:10.107122Z","submitted_at":"2026-07-08T02:54:03Z","title":"Adaptive Depth in Looped Transformers: Diagnosing Learned Halting Gates and Trajectory Readouts","version":1},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-02T08:13:27.955279Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2607.20519"},"observation_digest":"sha256:a521b5a2bc2121dd359f9a2666e799e19a2cafce79b4142255bda09f8a799842","observation_id":"2a202002-1871-4682-b60c-d6231fe49a92","resolution":{"observed_at":"2026-08-02T08:13:27.955279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-01T00:35:16.995160Z","title":"arXiv preprint arXiv:2107.05407 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.26192","last_updated":"2026-07-28T18:51:11Z","snapshot_observed_at":"2026-08-06T23:19:33.165293Z","submitted_at":"2026-07-28T18:51:11Z","title":"Dynamic Parameterization Is Not Dynamic Inference","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T00:35:16.995160Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2607.26192"},"observation_digest":"sha256:29082211f6ae4f28ad7b84264768dd2b86d563018dbb08133057a51c40dbef37","observation_id":"e0566e4b-55d9-47c0-b8eb-f3a6db0772f1","resolution":{"observed_at":"2026-08-01T00:35:16.995160Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-05T15:54:10.095999Z","title":"arXiv preprint arXiv:2107.05407 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.03624","last_updated":"2026-08-04T13:13:09Z","snapshot_observed_at":"2026-08-07T15:34:59.748923Z","submitted_at":"2026-08-04T13:13:09Z","title":"LoopMTP: A looped transformer guided by latent multi-token prediction","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-05T15:54:10.095999Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2608.03624"},"observation_digest":"sha256:fab25a76e157059cc3597b2ee52c39da23bfd8623e71f4d3e0110b4da4880fbc","observation_id":"bd53b1bb-93c3-47c5-ab03-7f7c662fa365","resolution":{"observed_at":"2026-08-05T15:54:10.095999Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2107.05407/citation-record","integrity":"/paper/2107.05407/integrity","json":"/paper/2107.05407/citation-record.json","paper":"/paper/2107.05407"},"outbound":[],"paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 33 inbound Pith citation observations for arXiv:2107.05407."}