{"as_of":"2026-08-08T08:32:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c91b0f06d5f94a2ae2ddc1c4740907853e7599cbe3dd2e236568177cc7388188","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T15:37:04.580971Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T19:14:30.601345Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-08-06T19:14:36.059388Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"cited_work":{"arxiv_id":"2505.14467","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.14467","snapshot_observed_at":"2026-08-06T19:14:36.059388Z","title":"Void in Language Models","venue":"cs.CL","work_id":"786753f2-1be4-478a-a39c-6e2b3081a15b","year":2025},"citing_paper":{"arxiv_id":"2507.06203","last_updated":"2025-07-10T16:43:36Z","snapshot_observed_at":"2026-08-07T04:57:37.201438Z","submitted_at":"2025-07-08T17:29:07Z","title":"A Survey on Latent Reasoning","version":2},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:30.601345Z"},"links":{"cited_paper":"/paper/2505.14467","citing_paper":"/paper/2507.06203"},"observation_digest":"sha256:f0bf176302ae7c1c41c5f70ebff5ce54c8b2ae4d57398457ff1e7b0af32ad353","observation_id":"69447c7f-8dad-4d53-bf91-c317bd6ff894","resolution":{"observed_at":"2026-08-06T19:14:36.150323Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.14467/citation-record","integrity":"/paper/2505.14467/integrity","json":"/paper/2505.14467/citation-record.json","paper":"/paper/2505.14467"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1610.01644","last_updated":"2018-11-22T23:40:00Z","snapshot_observed_at":"2026-07-06T05:13:30.860932Z","submitted_at":"2016-10-05T20:59:01Z","title":"Understanding intermediate layers using linear classifier probes","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.01644","snapshot_observed_at":"2026-08-07T15:36:58.593864Z","title":"Alain and Y","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:58.593864Z"},"links":{"cited_paper":"/paper/1610.01644","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:68815973f70e96c650918a1bc681f2f166508173dd1d09e1b7d16044a977e16a","observation_id":"fa4bd15f-d49d-4209-8da2-9ded7e238591","resolution":{"observed_at":"2026-08-07T15:36:58.593864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2107.05407","last_updated":"2021-09-02T08:48:41Z","snapshot_observed_at":"2026-07-06T11:28:17.810519Z","submitted_at":"2021-07-12T13:24:03Z","title":"PonderNet: Learning to Ponder","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2107.05407","snapshot_observed_at":"2026-08-07T15:36:58.718951Z","title":"Banino, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:58.718951Z"},"links":{"cited_paper":"/paper/2107.05407","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:94cad92f6fc4ffd9d008d639d2b5c64be5f9a3b1fcff9c6f0fe7c8541ad5c7b9","observation_id":"873463b9-15c2-4b66-95bc-6faf0e095f12","resolution":{"observed_at":"2026-08-07T15:36:58.718951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06297","last_updated":"2016-01-07T22:41:10Z","snapshot_observed_at":"2026-08-04T23:18:10.428920Z","submitted_at":"2015-11-19T18:40:22Z","title":"Conditional Computation in Neural Networks for faster models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06297","snapshot_observed_at":"2026-08-07T15:36:58.892257Z","title":"Bengio, P.-L","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:58.892257Z"},"links":{"cited_paper":"/paper/1511.06297","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:d741ed84b81ff3d677d5cac6b688676f807e41f9d71bc2d11eca51fc10fe1850","observation_id":"a2c6184e-205c-4cf4-beac-e7d7ec37ba99","resolution":{"observed_at":"2026-08-07T15:36:58.892257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1702.07811","last_updated":"2017-09-18T18:14:49Z","snapshot_observed_at":"2026-08-07T05:33:13.101914Z","submitted_at":"2017-02-25T00:22:51Z","title":"Adaptive Neural Networks for Efficient Inference","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1702.07811","snapshot_observed_at":"2026-08-07T15:36:59.079696Z","title":"Bolukbasi, J","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.079696Z"},"links":{"cited_paper":"/paper/1702.07811","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:1fee2fc072cfbb4772f747018297d64911005283fc2fa69c4855cb9947fadb33","observation_id":"ed75a120-24b3-4c15-b6e8-305eae4c7ad2","resolution":{"observed_at":"2026-08-07T15:36:59.079696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:59.256134Z","title":"Bricken, A","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.256134Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:d97aebbe946df1e6090d7ec2091e382bf176c01f81b541855b9b27e2236b81d7","observation_id":"f352b557-6218-4bb7-a1c8-0510b25aee15","resolution":{"observed_at":"2026-08-07T15:36:59.256134Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.03827","last_updated":"2024-03-02T21:33:53Z","snapshot_observed_at":"2026-08-03T01:53:33.505931Z","submitted_at":"2022-12-07T18:17:56Z","title":"Discovering Latent Knowledge in Language Models Without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.03827","snapshot_observed_at":"2026-08-07T15:36:59.383392Z","title":"Burns, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.383392Z"},"links":{"cited_paper":"/paper/2212.03827","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:3bb741ffdca6cfd6f6eff639e4e7631fb16a88945ce3401bbc91214870f3f10a","observation_id":"4988c437-5448-4fe1-9cc8-c204ebbebaf3","resolution":{"observed_at":"2026-08-07T15:36:59.383392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:36:59.550543Z","title":"Clark, K","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.550543Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:fbec08157adedfc7615ae1721fa06fc4eb41a0bf6cefa1b3c6b5bcf6dda650ba","observation_id":"a4d64958-c875-4326-b58f-ccf4c90a500e","resolution":{"observed_at":"2026-08-07T15:36:59.550543Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-07T15:36:59.676912Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.676912Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:161bf7b937a2e310cca846c86ad3e64d923320c89955e36db25301918c457a3d","observation_id":"7b673a29-efd3-42cc-84c9-18a63d6fb633","resolution":{"observed_at":"2026-08-07T15:36:59.676912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03819","last_updated":"2019-03-05T16:46:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2018-07-10T18:39:15Z","title":"Universal Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.03819","snapshot_observed_at":"2026-08-07T15:36:59.848221Z","title":"Dehghani, S","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.848221Z"},"links":{"cited_paper":"/paper/1807.03819","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:5f74f9e257986223025c67a6280a6f2151fa4c79110a76bdf04db0b377cc1f86","observation_id":"99f24031-3ea8-46cd-99aa-9d3d58ceff61","resolution":{"observed_at":"2026-08-07T15:36:59.848221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.12894","last_updated":"2022-03-16T13:27:44Z","snapshot_observed_at":"2026-08-05T04:07:00.934919Z","submitted_at":"2021-10-25T12:48:07Z","title":"The Efficiency Misnomer","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.12894","snapshot_observed_at":"2026-08-07T15:36:59.994585Z","title":"Dehghani, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-07T15:36:59.994585Z"},"links":{"cited_paper":"/paper/2110.12894","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:497dc1eabc5a02d76e12272ffc64aa2a179a51cc20462b1ea5c0b3db94e03f23","observation_id":"7e545c32-27ef-4436-acf9-f6d6a3c7699c","resolution":{"observed_at":"2026-08-07T15:36:59.994585Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:06.488399Z","title":"Elhage, N","venue":null,"work_id":"ab7283d5-33b9-4bfb-8115-d87230742d2b","year":2021},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.147782Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:cfc6540fe331f7faf7876ee32c90c0267b271415d5841f55c6a619ae0c666e9f","observation_id":"e53f27bf-7c6a-4825-8c69-014cfcdcb76a","resolution":{"observed_at":"2026-08-07T15:37:06.623108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:00.287721Z","title":"Elhage, T","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.287721Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:2fd0f5b48186ef26ca53e6d4a709badebbcecc152c4f0a8e510a2f6ba92bbf17","observation_id":"5cf928c6-d24b-4434-a01a-a8af82747cac","resolution":{"observed_at":"2026-08-07T15:37:00.287721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2012.14913","last_updated":"2021-09-05T17:32:27Z","snapshot_observed_at":"2026-08-07T23:50:29.977330Z","submitted_at":"2020-12-29T19:12:05Z","title":"Transformer Feed-Forward Layers Are Key-Value Memories","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2012.14913","snapshot_observed_at":"2026-08-07T15:37:00.457635Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.457635Z"},"links":{"cited_paper":"/paper/2012.14913","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:e1fce84275d68fc60221a2fa4e9d7983140d9a02032287c0e01c787066001475","observation_id":"699d5a3d-af2d-4962-a4ec-c0584f4b90c3","resolution":{"observed_at":"2026-08-07T15:37:00.457635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21783","last_updated":"2024-11-23T23:27:33Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:54:27Z","title":"The Llama 3 Herd of Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21783","snapshot_observed_at":"2026-08-07T15:37:00.573191Z","title":"Grattafiori, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.573191Z"},"links":{"cited_paper":"/paper/2407.21783","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:9c81840d83dbaf73d980f71054a69cb97f737a0efa7803e3d24e0a42d870435e","observation_id":"0fb6e4f7-512b-41aa-b566-e3e45f482c9e","resolution":{"observed_at":"2026-08-07T15:37:00.573191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1603.08983","last_updated":"2017-02-21T16:21:21Z","snapshot_observed_at":"2026-08-04T14:24:45.814840Z","submitted_at":"2016-03-29T22:09:00Z","title":"Adaptive Computation Time for Recurrent Neural Networks","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1603.08983","snapshot_observed_at":"2026-08-07T15:37:00.706705Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.706705Z"},"links":{"cited_paper":"/paper/1603.08983","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:247726e0e1c60a49e27352fd819f57b17c52672759e85b0bb6f1f0a91f096972","observation_id":"99e85293-965a-4eb8-8aa9-dc16056883d8","resolution":{"observed_at":"2026-08-07T15:37:00.706705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.17887","last_updated":"2025-03-03T17:02:05Z","snapshot_observed_at":"2026-08-03T06:33:46.668360Z","submitted_at":"2024-03-26T17:20:04Z","title":"The Unreasonable Ineffectiveness of the Deeper Layers","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.17887","snapshot_observed_at":"2026-08-07T15:37:00.813610Z","title":"Gromov, K","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.813610Z"},"links":{"cited_paper":"/paper/2403.17887","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:a6ec92d32a364613972a8ea64b7a69c839d96361dbd6f73c664b173644fe8e08","observation_id":"16d7c48b-a93a-4468-b8f5-be1252e80b84","resolution":{"observed_at":"2026-08-07T15:37:00.813610Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.01610","last_updated":"2023-06-02T21:52:17Z","snapshot_observed_at":"2026-08-02T17:50:59.894886Z","submitted_at":"2023-05-02T17:13:55Z","title":"Finding Neurons in a Haystack: Case Studies with Sparse Probing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.01610","snapshot_observed_at":"2026-08-07T15:37:00.997871Z","title":"Gurnee, N","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:00.997871Z"},"links":{"cited_paper":"/paper/2305.01610","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:22601ebef081640dd52c5bf96fdf75841bb06157655e42c74c2664bb0c54a647","observation_id":"e2b6e765-9c95-40d3-b93b-fc305eb639bd","resolution":{"observed_at":"2026-08-07T15:37:00.997871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:01.138851Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.138851Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:d441d7793a980973246065297cb2ec9f42647b89af4cc931d1b2a6c3dd112617","observation_id":"73fd28a1-4874-4559-9c0f-a983582ad277","resolution":{"observed_at":"2026-08-07T15:37:01.138851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:06.219936Z","title":"Hassibi and D","venue":null,"work_id":"67fbb9a0-ea51-45a1-bade-faf0df2ef9cf","year":1992},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.247365Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:47b91db1bc71efa1f319816d255e7fe6ea7feaf0828f91ca9469191d4984d02c","observation_id":"d4da5a8c-3571-4919-962c-a5864b03eec8","resolution":{"observed_at":"2026-08-07T15:37:06.358221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2009.03300","last_updated":"2021-01-12T18:57:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-09-07T17:59:25Z","title":"Measuring Massive Multitask Language Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.03300","snapshot_observed_at":"2026-08-07T15:37:01.373996Z","title":"Hendrycks, C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.373996Z"},"links":{"cited_paper":"/paper/2009.03300","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:04aa9ad2da40b72eb8d87b58a5ac6993945f9d38c7db7491f717c4bf7edd8d86","observation_id":"cac6ffb8-b734-499c-b8c2-24184107b073","resolution":{"observed_at":"2026-08-07T15:37:01.373996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2103.03874","last_updated":"2021-11-08T21:30:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-03-05T18:59:39Z","title":"Measuring Mathematical Problem Solving With the MATH Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.03874","snapshot_observed_at":"2026-08-07T15:37:01.524522Z","title":"Hendrycks, C","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.524522Z"},"links":{"cited_paper":"/paper/2103.03874","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:158b937afc8225b3aee9a4fb485f6940ce13b99a1652ebf289e8606705574b11","observation_id":"76cb7536-47c9-4911-a77d-6366df234cae","resolution":{"observed_at":"2026-08-07T15:37:01.524522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-07T15:37:01.642796Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.642796Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:ed6fb22751f225e10e7b6be690b85ea5d9fc9c1909719256cd4f0643e8c81f73","observation_id":"6a774c97-4270-4b0d-984e-faca2dc620cd","resolution":{"observed_at":"2026-08-07T15:37:01.642796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07066","last_updated":"2025-02-04T23:34:30Z","snapshot_observed_at":"2026-07-06T17:58:21.138881Z","submitted_at":"2024-04-10T14:56:40Z","title":"Exploring Concept Depth: How Large Language Models Acquire Knowledge and Concept at Different Layers?","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.07066","snapshot_observed_at":"2026-08-07T15:37:01.788971Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.788971Z"},"links":{"cited_paper":"/paper/2404.07066","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:01daf34163b5533173aaf54efb14627b8dda3882942351f42d60275631e51138","observation_id":"c5f99ce4-bf40-445a-88f4-8be739c36be6","resolution":{"observed_at":"2026-08-07T15:37:01.788971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16061","last_updated":"2024-03-04T13:37:48Z","snapshot_observed_at":"2026-07-06T17:35:06.195492Z","submitted_at":"2024-02-25T11:15:42Z","title":"How Large Language Models Encode Context Knowledge? A Layer-Wise Probing Study","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16061","snapshot_observed_at":"2026-08-07T15:37:01.925027Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:01.925027Z"},"links":{"cited_paper":"/paper/2402.16061","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:38d347f2b1a279fd50ff4b129463d0dbe6783471ddede397feedf4ab8ba6c374","observation_id":"3b0338e5-80cd-44b8-ad9b-cfc5141bdac2","resolution":{"observed_at":"2026-08-07T15:37:01.925027Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:02.080694Z","title":"LeCun, J","venue":null,"work_id":null,"year":1989},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.080694Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:699711d7b0aae6e5a6a76c40a45951003a6e578f4814a2e43694d812b24efb78","observation_id":"51613cad-122e-4d84-bd57-e6c7448a835f","resolution":{"observed_at":"2026-08-07T15:37:02.080694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1608.08710","last_updated":"2017-03-10T17:57:56Z","snapshot_observed_at":"2026-07-06T05:08:42.861486Z","submitted_at":"2016-08-31T02:29:59Z","title":"Pruning Filters for Efficient ConvNets","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1608.08710","snapshot_observed_at":"2026-08-07T15:37:02.184716Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.184716Z"},"links":{"cited_paper":"/paper/1608.08710","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:0e490bf18c2feb4a41db9362e9fd08d2483b64c4989050651d1f2a4c3fe5857d","observation_id":"954a902c-d72d-4bf2-812d-dc96f9ab562c","resolution":{"observed_at":"2026-08-07T15:37:02.184716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:05.974669Z","title":null,"venue":null,"work_id":"df305e92-af12-4771-b89e-03076f3b5a85","year":2017},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.304092Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:2af7647293c5798d8d5986967e4326658939a1b77b2372ae47a3538d222b7d79","observation_id":"033825a1-161c-4ec3-982f-71526440366c","resolution":{"observed_at":"2026-08-07T15:37:06.062736Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03853","last_updated":"2024-10-11T09:43:32Z","snapshot_observed_at":"2026-08-03T01:48:18.654934Z","submitted_at":"2024-03-06T17:04:18Z","title":"ShortGPT: Layers in Large Language Models are More Redundant Than You Expect","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03853","snapshot_observed_at":"2026-08-07T15:37:02.405282Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.405282Z"},"links":{"cited_paper":"/paper/2403.03853","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:261cc38976f7cbc736100f5f2fad5154adb80dbdd5f6124ac284e5bb135a9458","observation_id":"e6068d21-b904-4db1-9306-5cf52e15ecf8","resolution":{"observed_at":"2026-08-07T15:37:02.405282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16720","last_updated":"2026-04-30T02:46:40Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-21T18:04:31Z","title":"OpenAI o1 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16720","snapshot_observed_at":"2026-08-07T15:37:02.531472Z","title":"Jaech, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.531472Z"},"links":{"cited_paper":"/paper/2412.16720","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:6d8ca66dceac3f81bb35b2f46e23c1dd9b9dda97df5ca4c87b058a2727d03ad5","observation_id":"70260c7e-1ff2-4b86-824b-445cf1d788cc","resolution":{"observed_at":"2026-08-07T15:37:02.531472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02707","last_updated":"2025-05-18T11:18:56Z","snapshot_observed_at":"2026-08-04T21:25:41.967552Z","submitted_at":"2024-10-03T17:31:31Z","title":"LLMs Know More Than They Show: On the Intrinsic Representation of LLM Hallucinations","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02707","snapshot_observed_at":"2026-08-07T15:37:02.661844Z","title":"Orgad, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.661844Z"},"links":{"cited_paper":"/paper/2410.02707","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:7b9080e2ffa6cc6ffe4793476d7569a04a7f651ca83c66573c3dd5a66f8f9c91","observation_id":"cbed722c-36f6-499c-813b-3ad124f2d2c1","resolution":{"observed_at":"2026-08-07T15:37:02.661844Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15115","last_updated":"2025-01-03T02:18:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-19T17:56:09Z","title":"Qwen2.5 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15115","snapshot_observed_at":"2026-08-07T15:37:02.773561Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.773561Z"},"links":{"cited_paper":"/paper/2412.15115","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:ca1778ce3c464ed4dabdd1252bad4e0a034d50ca2d84b1113300a36845ed4af6","observation_id":"5a508e4b-50c5-47bd-8fae-0ffd065e86f6","resolution":{"observed_at":"2026-08-07T15:37:02.773561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.12022","last_updated":"2023-11-20T18:57:34Z","snapshot_observed_at":"2026-08-04T22:55:15.345443Z","submitted_at":"2023-11-20T18:57:34Z","title":"GPQA: A Graduate-Level Google-Proof Q&A Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.12022","snapshot_observed_at":"2026-08-07T15:37:02.889990Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:02.889990Z"},"links":{"cited_paper":"/paper/2311.12022","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:566e9773e98b71b09606b7b07377620cf38a089e29a776f6fc2592bcaf97f1b9","observation_id":"378ba57e-98b1-4dfc-be1b-6ae9a82c9ff7","resolution":{"observed_at":"2026-08-07T15:37:02.889990Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2207.07061","last_updated":"2022-10-25T17:44:17Z","snapshot_observed_at":"2026-07-06T13:31:28.340143Z","submitted_at":"2022-07-14T17:00:19Z","title":"Confident Adaptive Language Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.07061","snapshot_observed_at":"2026-08-07T15:37:03.036731Z","title":"Schuster, A","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.036731Z"},"links":{"cited_paper":"/paper/2207.07061","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:7b3cbabc51592dc818f7853eb1b7f9e7afd628281508677ade8e9484ee1bc73b","observation_id":"22378bbd-5427-4fc9-afa4-e41b9c43a8ed","resolution":{"observed_at":"2026-08-07T15:37:03.036731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:05.692272Z","title":"Shemiranifar and M","venue":null,"work_id":"5586e636-8859-40b2-97d5-4aa16b701f9b","year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.146130Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:19adc56ee529b08dacabab4d904a7f9a3a3afb3b101c84995cd5693ec9f4cab9","observation_id":"88d18ae0-28a9-42ec-9219-74f5fab10ff8","resolution":{"observed_at":"2026-08-07T15:37:05.825349Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:03.244485Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.244485Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:00581c4ead39a636a6465092dea161f28688775e295ec7252f271bcfe580e99e","observation_id":"53f15bcb-6371-489e-8537-0aee4671e112","resolution":{"observed_at":"2026-08-07T15:37:03.244485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:03.387903Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.387903Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:910646a7f0b1e20e6a2d20dba42716d87fba5f4bd125270ebba5f59e9197dcbe","observation_id":"2845dc95-6ca7-4b1c-a3aa-8649f4756add","resolution":{"observed_at":"2026-08-07T15:37:03.387903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-07T15:37:03.554660Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.554660Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:e20b681311edcc09e506eaeb3e4e8a89634ec1d90513b744df9706500ebd8cc9","observation_id":"498a66e8-0e85-4739-925d-87adffcf6165","resolution":{"observed_at":"2026-08-07T15:37:03.554660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.09485","last_updated":"2018-07-25T06:13:24Z","snapshot_observed_at":"2026-08-03T17:15:06.917179Z","submitted_at":"2017-11-26T23:03:37Z","title":"SkipNet: Learning Dynamic Routing in Convolutional Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.09485","snapshot_observed_at":"2026-08-07T15:37:03.691040Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.691040Z"},"links":{"cited_paper":"/paper/1711.09485","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:d3e671c0d6af580bb1ee6802b5fbe8d73401c2a3bb275babdf6814c26367a102","observation_id":"66c14716-2a6d-45fc-ba5d-5960b08d53b8","resolution":{"observed_at":"2026-08-07T15:37:03.691040Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13195","last_updated":"2023-06-03T06:19:23Z","snapshot_observed_at":"2026-07-06T14:46:15.598295Z","submitted_at":"2023-01-30T18:57:24Z","title":"Adaptive Computation with Elastic Input Sequence","version":2},"cited_work":{"arxiv_id":"2301.13195","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.13195","snapshot_observed_at":"2026-08-07T15:37:04.689538Z","title":"Adaptive Computation with Elastic Input Sequence","venue":"cs.LG","work_id":"3905184c-fa8a-4c0b-aa08-9daa272e75fb","year":2023},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.823949Z"},"links":{"cited_paper":"/paper/2301.13195","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:f1925517ad2ada0d67770ae08965d04276561432cbcf3f0b70db9c6d8eb5cbb9","observation_id":"ba5a40a2-37ca-4cb3-b7c7-8d259ea5026a","resolution":{"observed_at":"2026-08-07T15:37:04.833566Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:05.390590Z","title":null,"venue":null,"work_id":"deb58c38-8134-4ca9-ba16-4109ae707c40","year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:03.936524Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:3cf1f416fac37d8d07c268ed3e23492c7ce41bcc48eff81f3f6d8fb9dd792e80","observation_id":"2d1085b8-4882-4933-9799-861253e4bc1e","resolution":{"observed_at":"2026-08-07T15:37:05.545002Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18218","last_updated":"2024-10-20T09:10:25Z","snapshot_observed_at":"2026-08-06T18:43:32.229808Z","submitted_at":"2024-05-28T14:21:15Z","title":"FinerCut: Finer-grained Interpretable Layer Pruning for Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18218","snapshot_observed_at":"2026-08-07T15:37:04.051595Z","title":"Zhang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:04.051595Z"},"links":{"cited_paper":"/paper/2405.18218","citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:5a970ea60bd7ccb8bc0b72beb3f5546e010ec29b2b092bb41c722a52835c50e5","observation_id":"e0b856c5-8c56-4c34-b0c6-ca25d76a25b2","resolution":{"observed_at":"2026-08-07T15:37:04.051595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:04.187227Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:04.187227Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:eae4d09f9794d19d6755a10a5f5a6bc273eb845c3dcc63eb0db2dbd6b2a25218","observation_id":"82be5ab9-4f8d-406e-8614-4458437a510a","resolution":{"observed_at":"2026-08-07T15:37:04.187227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:04.322961Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:04.322961Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:aa7b92cbd1041d89883c6cd8a53831723f3ab7153ced8049c094692000bd11e6","observation_id":"45edec69-fcdb-433c-bc2a-06c07cd192d8","resolution":{"observed_at":"2026-08-07T15:37:04.322961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:04.453416Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:04.453416Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:87c6011e1d7fc8a9a43775bdf0948ecf69e790869afa61a12021901445836221","observation_id":"4d88a3ae-cf5a-4200-89eb-a7d277597e5e","resolution":{"observed_at":"2026-08-07T15:37:04.453416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T15:37:05.149615Z","title":null,"venue":null,"work_id":"084e8a62-760c-41e1-ab58-fb946aae4449","year":null},"citing_paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-07T15:37:04.580971Z"},"links":{"citing_paper":"/paper/2505.14467"},"observation_digest":"sha256:e4d7e980700a0600e5b01a4ca8f2da19efe5709f8bfc94eaef98441c8c4038a0","observation_id":"7b5ddd7d-59ed-4262-908c-c997da406cb2","resolution":{"observed_at":"2026-08-07T15:37:05.209798Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.14467","last_updated":"2025-05-20T15:01:56Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T23:37:44.957755Z","submitted_at":"2025-05-20T15:01:56Z","title":"Void in Language Models"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":41,"verified_exact":1,"verified_fuzzy":3},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 1 inbound Pith citation observation for arXiv:2505.14467."}