{"as_of":"2026-08-15T16:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e91fe44af0958c812add9aba41e4a6495b6999c77182f6af8098975c09970d48","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T16:59:58.529650Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":19,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":19,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-10T22:11:10.610050Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":3,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-10T22:11:10.610050Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2501.02772","last_updated":"2025-05-30T15:15:19Z","snapshot_observed_at":"2026-08-12T16:00:58.888727Z","submitted_at":"2025-01-06T05:29:00Z","title":"GeAR: Generation Augmented Retrieval","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-10T22:11:10.610050Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2501.02772"},"observation_digest":"sha256:c4557aca13e3777fe2e0297acf9aff54b2d6792b86a9fc31cc165b81478ce6fd","observation_id":"38741e9c-cc6e-40cf-ba4d-b36f15a7284d","resolution":{"observed_at":"2026-08-10T22:11:10.610050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-10T14:12:09.311351Z","title":"Skean, M","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.15570","last_updated":"2025-01-26T15:56:56Z","snapshot_observed_at":"2026-08-12T17:42:30.931117Z","submitted_at":"2025-01-26T15:56:56Z","title":"ARWKV: Pretrain is not what we need, an RNN-Attention-Based Language Model Born from Transformer","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-10T14:12:09.311351Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2501.15570"},"observation_digest":"sha256:7494e97bc9aed60b55d3401f6c126a7e9f4a1dbae2170c4738b0b9a4fc3a5206","observation_id":"f7266d44-4367-4cd9-a15a-43d57ceda7f9","resolution":{"observed_at":"2026-08-10T14:12:09.311351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2502.05171","last_updated":"2025-02-17T17:14:04Z","snapshot_observed_at":"2026-08-15T00:53:48.099058Z","submitted_at":"2025-02-07T18:55:02Z","title":"Scaling up Test-Time Compute with Latent Reasoning: A Recurrent Depth Approach","version":2},"reference_index":143,"source":"arxiv_source","source_observed_at":"2026-05-12T15:39:40.845703Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2502.05171"},"observation_digest":"sha256:bac30d20d644466d1a38e169fea798554102ae6a13993132fae05bf19c79b40e","observation_id":"4d77eb05-aa9f-4983-84ec-cfa0e317add9","resolution":{"observed_at":"2026-05-12T15:39:41.221886Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-07T15:15:18.301774Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.15710","last_updated":"2025-05-21T16:21:29Z","snapshot_observed_at":"2026-08-08T20:58:02.100576Z","submitted_at":"2025-05-21T16:21:29Z","title":"Advancing LLM Safe Alignment with Safety Representation Ranking","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T15:15:18.301774Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2505.15710"},"observation_digest":"sha256:02e76e29284f11d32966a0d2f9421db984932b6f45b61264718287c2c4ac6064","observation_id":"7dabb801-295a-4f10-89af-fd05c45770ad","resolution":{"observed_at":"2026-08-07T15:15:18.301774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-07T14:40:51.932947Z","title":"Skean, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18132","last_updated":"2025-06-17T09:32:43Z","snapshot_observed_at":"2026-08-14T05:10:56.832153Z","submitted_at":"2025-05-23T17:41:54Z","title":"BiggerGait: Unlocking Gait Recognition with Layer-wise Representations from Large Vision Models","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:40:51.932947Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2505.18132"},"observation_digest":"sha256:875b6c1bd51a0fb2964dafed953e1bbd529cd1687b3b5ea0b79b7a88197fafc7","observation_id":"d2feb8d8-cc01-4e7a-a99c-877556bd1d68","resolution":{"observed_at":"2026-08-07T14:40:51.932947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-07T14:50:10.866679Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18215","last_updated":"2025-05-23T05:46:42Z","snapshot_observed_at":"2026-08-14T18:56:26.334745Z","submitted_at":"2025-05-23T05:46:42Z","title":"Do BERT-Like Bidirectional Models Still Perform Better on Text Classification in the Era of LLMs?","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-07T14:50:10.866679Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2505.18215"},"observation_digest":"sha256:4d163feb8401bba187e2cf665a6048742f98c45972395ac4e34b8b4139a9f515","observation_id":"aedf8f49-539e-4d43-af3f-bac88ca07f90","resolution":{"observed_at":"2026-08-07T14:50:10.866679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-07T12:11:26.356859Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00382","last_updated":"2025-06-04T18:25:14Z","snapshot_observed_at":"2026-08-09T06:54:23.404288Z","submitted_at":"2025-05-31T04:21:39Z","title":"Spectral Insights into Data-Oblivious Critical Layers in Large Language Models","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-07T12:11:26.356859Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2506.00382"},"observation_digest":"sha256:f0f377a2c012ee1381565f8f1fd66ab29e40948fe8b47791ed068584a39a6790","observation_id":"38a3f17b-1e7b-4750-8d14-2786b2ee0665","resolution":{"observed_at":"2026-08-07T12:11:26.356859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2506.01770","last_updated":"2026-04-18T05:40:12Z","snapshot_observed_at":"2026-08-15T02:56:03.854072Z","submitted_at":"2025-06-02T15:17:38Z","title":"ReGA: Model-Based Safeguard for LLMs via Representation-Guided Abstraction","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-19T11:34:09.428653Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2506.01770"},"observation_digest":"sha256:690d9fb403ed71ee75caedd77f0750f8333e15cbeac07499cf1569e231fe77f3","observation_id":"ff316dfd-fd58-432e-9605-7b1e0d75d9ae","resolution":{"observed_at":"2026-05-19T11:37:15.991021Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-06T19:14:30.944067Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.06203","last_updated":"2025-07-10T16:43:36Z","snapshot_observed_at":"2026-08-07T04:57:37.201438Z","submitted_at":"2025-07-08T17:29:07Z","title":"A Survey on Latent Reasoning","version":2},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-06T19:14:30.944067Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2507.06203"},"observation_digest":"sha256:5555d7bc61a2e31f277e057bc6f62f23747c75ec899f365224f616f77f2def4d","observation_id":"1916055a-3fc4-41a4-baa6-59cd3dbda793","resolution":{"observed_at":"2026-08-06T19:14:30.944067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T21:10:35.662275Z","title":"R., LeCun, Y., and Shwartz-Ziv, R","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.10057","last_updated":"2025-08-12T21:38:46Z","snapshot_observed_at":"2026-08-13T13:10:53.109705Z","submitted_at":"2025-08-12T21:38:46Z","title":"Large Language Models Show Signs of Alignment with Human Neurocognition During Abstract Reasoning","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-05T21:10:35.662275Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2508.10057"},"observation_digest":"sha256:819dfbaa59eba39de924e448b478117b1f04f2e1169eaee2fb451d69477a2d8d","observation_id":"373880ed-9c1a-4766-85ec-f8f70bcf066e","resolution":{"observed_at":"2026-08-05T21:10:35.662275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2602.02280","last_updated":"2026-05-12T03:47:11Z","snapshot_observed_at":"2026-08-11T07:06:38.718933Z","submitted_at":"2026-02-02T16:20:51Z","title":"RACC: Representation-Aware Coverage Criteria for LLM Safety Testing","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-16T08:12:55.296932Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2602.02280"},"observation_digest":"sha256:6750c537b075a543a0f8c18516c82218d5417c7294ecdc70d7ddbe140cdf9d06","observation_id":"ef612357-ad60-4f53-8d6f-859b207a5135","resolution":{"observed_at":"2026-05-16T08:17:36.670300Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2604.01833","last_updated":"2026-04-03T09:26:05Z","snapshot_observed_at":"2026-08-15T14:53:03.198403Z","submitted_at":"2026-04-02T09:46:20Z","title":"Language-Pretraining-Induced Bias: A Strong Foundation for General Vision Tasks","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-13T21:07:34.826584Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2604.01833"},"observation_digest":"sha256:71e13c0b09ab071032e72dc2ea300d97705d7fbf0aa85855a59fcd75db55c047","observation_id":"6565c4b6-7872-47dd-b75f-610c35b78769","resolution":{"observed_at":"2026-05-13T21:08:17.595243Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2604.18756","last_updated":"2026-04-20T19:00:09Z","snapshot_observed_at":"2026-08-14T07:51:40.546112Z","submitted_at":"2026-04-20T19:00:09Z","title":"Towards Understanding the Robustness of Sparse Autoencoders","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T05:44:24.532548Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2604.18756"},"observation_digest":"sha256:bee58cfe5b9ed11a0a0ec521d4daa020a34098928cb313c2ed9ae720ce62b267","observation_id":"25463d7c-8fc2-4e78-9dbb-692e3a575feb","resolution":{"observed_at":"2026-05-10T05:46:10.239416Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2605.27970","last_updated":"2026-05-27T05:04:29Z","snapshot_observed_at":"2026-08-01T18:47:42.892145Z","submitted_at":"2026-05-27T05:04:29Z","title":"Geometry of Human Perceptual Domains Emerges Transiently in LLM Representations","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-29T12:31:21.660647Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2605.27970"},"observation_digest":"sha256:796f67e27e8ea453a9f22568d22d616475a5185f819a49884e9bc7852165a14b","observation_id":"839fe2ab-6414-47f0-8007-1fd57429caab","resolution":{"observed_at":"2026-06-29T12:33:24.311509Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2606.03093","last_updated":"2026-06-02T03:27:24Z","snapshot_observed_at":"2026-08-13T13:45:03.571573Z","submitted_at":"2026-06-02T03:27:24Z","title":"Decomposing how prompting steers behavior","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-28T10:39:58.885284Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2606.03093"},"observation_digest":"sha256:371dba80881c6cfb49287bb3c55a6bcac28584c0aed81ce53fe28bbb7576866c","observation_id":"7724db8c-cf5b-404d-9bfc-f207366167ab","resolution":{"observed_at":"2026-07-02T02:46:28.660348Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2606.06315","last_updated":"2026-06-04T15:54:34Z","snapshot_observed_at":"2026-08-13T04:02:14.220214Z","submitted_at":"2026-06-04T15:54:34Z","title":"LLM Self-Recognition: Steering and Retrieving Activation Signatures","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-28T01:41:03.518190Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2606.06315"},"observation_digest":"sha256:fec698bc7dda461a268a001547226f19da4215bedca9e6415339dcf769f50cd7","observation_id":"b8fcbd11-3213-425d-9e49-60b9082053de","resolution":{"observed_at":"2026-06-28T01:41:29.175499Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2606.07526","last_updated":"2026-04-20T07:48:41Z","snapshot_observed_at":"2026-08-12T23:49:40.047183Z","submitted_at":"2026-04-20T07:48:41Z","title":"GraphLoRA: Structure-Aware Low-Rank Adaptation for Large Language Model Recommendation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-07-05T15:15:33.204246Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2606.07526"},"observation_digest":"sha256:8e87c6125c36554301186465beb79f234b1a30c93462f365152461db8bb647f2","observation_id":"825188cc-1c04-45fb-9310-a17128143aaf","resolution":{"observed_at":"2026-07-05T15:21:13.051880Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2606.30813","last_updated":"2026-06-29T18:37:34Z","snapshot_observed_at":"2026-08-14T12:09:47.392599Z","submitted_at":"2026-06-29T18:37:34Z","title":"Gradient Smoothing: Coupling Layer-wise Updates for Improved Optimization","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-01T06:36:48.524846Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2606.30813"},"observation_digest":"sha256:cbe2f538a14a577abfe309e52b9169367daa733b2441ea9e87a3605ceeec751c","observation_id":"e6b5d999-8399-4126-979c-e4dd040d418c","resolution":{"observed_at":"2026-07-01T09:25:41.201619Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"cited_work":{"arxiv_id":"2412.09563","doi":"10.48550/arxiv.2412.09563","metadata_source":"pith","pith_arxiv_id":"2412.09563","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Does representation matter? exploring intermediate layers in large language models","venue":"cs.LG","work_id":"89d95852-ef1d-4e02-bd6b-e416089db508","year":2024},"citing_paper":{"arxiv_id":"2607.08399","last_updated":"2026-07-09T12:21:44Z","snapshot_observed_at":"2026-08-05T01:38:41.823519Z","submitted_at":"2026-07-09T12:21:44Z","title":"Prompt Compression via Activation Aggregation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-07-10T08:03:46.297577Z"},"links":{"cited_paper":"/paper/2412.09563","citing_paper":"/paper/2607.08399"},"observation_digest":"sha256:71517cca3c4c6eed91c3c592f66950f000a949e8a6f6f4af281415c9212fc77d","observation_id":"07f14b3a-ccfe-4960-944e-2202ba08d69a","resolution":{"observed_at":"2026-07-10T08:06:57.505320Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-18T08:21:04.271693+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.09563/citation-record","integrity":"/paper/2412.09563/integrity","json":"/paper/2412.09563/citation-record.json","paper":"/paper/2412.09563"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.446029Z","title":"- ReQ : Assessing representation quality in self-supervised learning by measuring eigenspectrum decay","venue":null,"work_id":"b7f4ccca-c90f-4fbd-b163-622561082597","year":2022},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.239572Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:fef47a34c101674ab2cf3af36660a8b4f1c01882005404f61c0a2d2160785b62","observation_id":"b8647aa1-f217-46f2-9d37-6d222eb829f6","resolution":{"observed_at":"2026-08-11T16:59:59.451868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.424946Z","title":"Understanding intermediate layers using linear classifier probes","venue":null,"work_id":"a85dffb3-9f9f-4d34-aef4-3651942ece53","year":2017},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.245580Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:ce787bf945b07af386ce9033507dca621a8010a00a73cd9234f2f1ed72d77fc9","observation_id":"0fcb49b4-e382-4e75-a633-857e7e568ca5","resolution":{"observed_at":"2026-08-11T16:59:59.431444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.406429Z","title":"Information theory with kernel methods","venue":null,"work_id":"83d61fce-962e-4ed5-9f75-6e20fc5fbb37","year":2022},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.251972Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:afdf2759e9b2759707550c48ceba500847217cca6a31c86a9df2c1aaff20ac34","observation_id":"5de5f0c6-8735-4478-9118-d4f209dbd2a2","resolution":{"observed_at":"2026-08-11T16:59:59.412492Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.383441Z","title":"LLM2Vec : Large language models are secretly powerful text encoders","venue":null,"work_id":"e0dd6f19-0c50-4a31-b44b-babfca07bde7","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.257934Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:b78f5accc261c5a4ebf6315a1f92938710967df83f47bf6f4c3a373ca3ea84e4","observation_id":"403b2822-ad4b-438a-9949-9ea4598aa1b4","resolution":{"observed_at":"2026-08-11T16:59:59.389633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.363302Z","title":"Reverse engineering self-supervised learning","venue":null,"work_id":"2b37c323-624c-466c-ae77-90eca2b4600b","year":2023},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.264631Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:31999df04f6c54bdbb66d86f6ba74c7ec98a86552246a3a85361146af546475e","observation_id":"e20e718f-735d-4f82-8d05-6e0b13d55ccc","resolution":{"observed_at":"2026-08-11T16:59:59.368933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.344388Z","title":"Pythia: A suite for analyzing large language models across training and scaling","venue":null,"work_id":"0c183fd5-7039-4098-9536-c91376c85c39","year":2023},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.272426Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:11ce1ea8c2ecfd424235bd89c2ad7db15db2e63d3cce62270ab92db61fbbe26d","observation_id":"da585faa-585f-45f4-a9f6-f6283b5cd518","resolution":{"observed_at":"2026-08-11T16:59:59.350609Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.324603Z","title":"Von neumann entropy from unitarity","venue":null,"work_id":"9ced133c-a93a-420a-90c9-dac8bd2be5c3","year":2019},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.280581Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:f0b1dcd44cd63f3b77e73e720a8400dc37e53c5fe0a0f642e3b6cd068f2b6e9d","observation_id":"ee0cd27c-bc51-4a34-95cf-4a0efa005ae6","resolution":{"observed_at":"2026-08-11T16:59:59.330440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.307869Z","title":"Guillotine regularization: Why removing layers is needed to improve generalization in self-supervised learning","venue":null,"work_id":"c91ab34c-36e3-4652-8097-db4f506ac228","year":2023},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.287359Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:33440d0580c2e37853cb571f32ff0a80fd857cb9e1362ad61fde34d29f54db1d","observation_id":"252af3a0-32fe-496d-b770-159dc1611fea","resolution":{"observed_at":"2026-08-11T16:59:59.312889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.288943Z","title":"Discovering latent knowledge in language models without supervision","venue":null,"work_id":"e3486054-35d8-4467-b749-6c8d6a01d832","year":2022},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.292959Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:6b85351d74da4d685d4187d460d30f4269e6098480bedda719d7981093f63e10","observation_id":"84cd2541-21cf-4877-819b-789c6a31dbaf","resolution":{"observed_at":"2026-08-11T16:59:59.295565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.299763Z","title":"A simple framework for contrastive learning of visual representations","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.299763Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:3a20cd3800abb5a0694f1c2897b7c823bc38296c07cf45e4bdca246a1af9ddb7","observation_id":"bec19c3a-62fa-41eb-8a27-fb611418551f","resolution":{"observed_at":"2026-08-11T16:59:58.299763Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.255924Z","title":"Improved baselines with momentum contrastive learning","venue":null,"work_id":"cd05f688-a60d-467f-b60e-d72bf1ddd35c","year":2020},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.304969Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:8d00dc5734b956178fcbf205bf556428b615ee714c0c3fbe15de6569d9514199","observation_id":"0475d2d5-f1e4-4667-b804-ef5fc3e69b1a","resolution":{"observed_at":"2026-08-11T16:59:59.261257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.238551Z","title":"Not all layers of llms are necessary during inference","venue":null,"work_id":"73c4da8b-799d-4a1f-9e2e-d21e481ccaf4","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.312493Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:88d029a100169fcaabde7b514bdc9a0cb6bd433a230d724ec198eca09f90f9ca","observation_id":"8751f97a-40df-4d1c-bb67-55b8092892e7","resolution":{"observed_at":"2026-08-11T16:59:59.243854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.219368Z","title":"The pile: An 800gb dataset of diverse text for language modeling","venue":null,"work_id":"479b9443-331c-4409-9a24-46b59f16f2dc","year":2020},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.321078Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:3b4d70cfcb3230e31e7c6122070c9309343f466afac21aee9df2b276516ae802","observation_id":"9137c9ab-16a5-4ad0-8fc0-2318a4009424","resolution":{"observed_at":"2026-08-11T16:59:59.225071Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.199901Z","title":"RankMe : Assessing the downstream performance of pretrained self-supervised representations by their rank","venue":null,"work_id":"de460f55-6aac-4e22-a039-c23c5fd9c04f","year":2023},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.326612Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:d1118c2ba239b4cccf76cef7547ee8939360e4b89a0a31d651ba5e485d3bf6ce","observation_id":"f25b1098-4151-4421-9646-d882a7ae7536","resolution":{"observed_at":"2026-08-11T16:59:59.205665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.181759Z","title":"Measures of entropy from data using infinitely divisible kernels","venue":null,"work_id":"000a9687-f661-4d0a-aee9-b0db37dfa8c1","year":2014},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.332668Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:339c040a714ff43ceb3b2a345bc34c598a03d10bfd9f3775ccab35f7eda852ae","observation_id":"e37ec127-b3da-4dca-8dca-4124251a9bef","resolution":{"observed_at":"2026-08-11T16:59:59.187233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.162668Z","title":"Mamba: Linear-time sequence modeling with selective state spaces","venue":null,"work_id":"62e89799-52e0-4909-adec-675faac877dc","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.338052Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:9fe45583ca47c60a319cf981e8eefe1266160d53f541f17f2afd38099c3f9e48","observation_id":"3c457f0d-e4d1-42d6-bb0d-f6a21456931a","resolution":{"observed_at":"2026-08-11T16:59:59.168131Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.142038Z","title":"Language models represent space and time","venue":null,"work_id":"842c851a-71ce-4f0d-afa0-801a4889f3da","year":2023},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.344107Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:daafb3fd6cff6881a9694a0807108e59ffe0c62120c5681b41a0cd9b9a0087a7","observation_id":"c3b5ace5-8ea3-4a3c-b5c8-264fd6de3c34","resolution":{"observed_at":"2026-08-11T16:59:59.148653Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.122921Z","title":"The dip test of unimodality","venue":null,"work_id":"0a42a16c-ad7d-402b-870d-1499c5f2da66","year":1985},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.350879Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:c7959d361f08bb5eae401b9772872ece4fd4c6c110f155a9cd599cd0736c3a29","observation_id":"10a0d534-96ed-42d1-9636-3051ec5b8664","resolution":{"observed_at":"2026-08-11T16:59:59.129052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.357033Z","title":"Measuring massive multitask language understanding","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.357033Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:621cddabca93fb97af86d0f406aa9d16192310c01f25751be289ca344dacf21d","observation_id":"2ce3976b-12b1-405c-9125-e4edb620bd2e","resolution":{"observed_at":"2026-08-11T16:59:58.357033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.087519Z","title":"Large language models implicitly learn to straighten neural sentence trajectories to construct a predictive representation of natural language","venue":null,"work_id":"15d1cb5a-f5f3-40c5-b610-5d7b00b201d2","year":2023},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.361936Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:921a27759365a4c3fdde04263803474d649c16292c85060da19b240611144d1a","observation_id":"e6604718-053a-4efb-b0cf-b604d790d1eb","resolution":{"observed_at":"2026-08-11T16:59:59.093063Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.066165Z","title":"Exploring concept depth: How large language models acquire knowledge at different layers? arXiv, 2024","venue":null,"work_id":"0fc25a9c-0c49-4b90-ad48-9d8f35cd9cfe","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.372602Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:6f6586da6a2e2e8c539752e35515155b5bf2e164dbebbd6f27f14154be3092f6","observation_id":"2978b2ec-0cbd-40f8-976c-057eaf0fdfa4","resolution":{"observed_at":"2026-08-11T16:59:59.072428Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.045336Z","title":"The remarkable robustness of llms: Stages of inference? arXiv, 2024","venue":null,"work_id":"bf2d7574-8dd6-420d-b93b-9e9140df6136","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.377401Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:ff8c9073685520226d90ad0199af508ba7bcf6c3dc61fe39df2ba70d3b1b5f51","observation_id":"f4da9fec-29ac-4656-b673-c6968ee5bce4","resolution":{"observed_at":"2026-08-11T16:59:59.052280Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.023678Z","title":"Linguistic knowledge and transferability of contextual representations","venue":null,"work_id":"a39abdbe-1a66-4a12-a76f-0efe6cc0d9bc","year":2019},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.383326Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:295b7c667d9a34b63f1240937c16e8ca4b264de5da8d6b3ab47573c282fabf1c","observation_id":"dc689ede-0c1f-4f62-9851-250d60321b01","resolution":{"observed_at":"2026-08-11T16:59:59.030438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:59.002253Z","title":"Bm25s: Orders of magnitude faster lexical search via eager sparse scoring, 2024","venue":null,"work_id":"05f81982-5c26-4429-a56d-69efff632cec","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.388662Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:028085d174b00ec12ea1e44b9140e2e8e6ae74801c569e0bcec372df8f4f0449","observation_id":"2587c43a-bffc-46e4-bc8e-40d2bb1979a4","resolution":{"observed_at":"2026-08-11T16:59:59.008977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.396374Z","title":"Nlp augmentation","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.396374Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:0d5687e004cba211e349af4fef76693e04e38be29e71a6c1ce632f66bc238e34","observation_id":"4c13fe07-e520-480d-9121-77eaad4163b7","resolution":{"observed_at":"2026-08-11T16:59:58.396374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.961906Z","title":"Eliciting latent knowledge from quirky language models","venue":null,"work_id":"1e602807-278a-4e63-863d-92f29ed84bb0","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.403884Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:75357320a8908b349b07f917aa9acadb2dcd86fe514a4b0042db7f13d866444b","observation_id":"2ee87086-ec0d-4961-b1a3-d9af39d1390a","resolution":{"observed_at":"2026-08-11T16:59:58.968684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.941343Z","title":"Emergence of separable manifolds in deep language representations","venue":null,"work_id":"36be2202-5876-4946-9135-c077936c870b","year":2020},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.411453Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:0194704766fe751ad1bc028593c656d7595ee1e9f361580e7b7151ba8cc96476","observation_id":"def7d528-8650-450a-988e-2c439e16eb77","resolution":{"observed_at":"2026-08-11T16:59:58.947593Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.417597Z","title":"Pointer sentinel mixture models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.417597Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:cc2e4e092817ca6bf8c4bf97f6e459a931e0a6458bae465954ef1f392be55a0a","observation_id":"776250be-3cd4-4715-a6bb-a346bb3b7e83","resolution":{"observed_at":"2026-08-11T16:59:58.417597Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.910898Z","title":"MTEB : Massive text embedding benchmark","venue":null,"work_id":"124f02d7-0cb8-4c62-898f-58d344508959","year":2022},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.424140Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:1f266b28cc108a3efc55f89484fb03d459917992e55d23bdd32939b58c653545","observation_id":"dafe7464-c6e8-4be7-8219-061c111b0b56","resolution":{"observed_at":"2026-08-11T16:59:58.915973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.893450Z","title":"Representation learning with contrastive predictive coding","venue":null,"work_id":"5bd79c09-5b09-465a-a9ae-6e25b14e61de","year":2018},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.430658Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:500285f9736c16b86c48ebff9a293186bec3d2524ef2a5431905a13516bd960c","observation_id":"6a63692e-533e-470e-9142-9381aa6d4aac","resolution":{"observed_at":"2026-08-11T16:59:58.899432Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.436277Z","title":"The linear representation hypothesis and the geometry of large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.436277Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:f06941f71562358164c0a23fefb7b65bcd4070c77b27de03b763386db319904b","observation_id":"b15f9091-dfcc-45a1-8792-fa47dfef9f6c","resolution":{"observed_at":"2026-08-11T16:59:58.436277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.860790Z","title":"SVCCA : Singular vector canonical correlation analysis for deep learning dynamics and interpretability","venue":null,"work_id":"db7f135e-187f-478d-aacb-a3723a39b46c","year":2017},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.441864Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:1648f34f0bbd7783c013167d9b60cc38b5af65ff7dace39c593d3f419fd744ef","observation_id":"6c5a641c-02f6-4511-8633-d95cac1e7548","resolution":{"observed_at":"2026-08-11T16:59:58.867730Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.839001Z","title":"On measures of entropy and information","venue":null,"work_id":"8f998eae-f9b7-419d-9fe3-7c0d479ccf50","year":1961},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.447319Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:913412d2aac680e07c47c69e74bbaf7749aa76f25fa2215d465fdd251ea4cdcd","observation_id":"79b14e42-5124-419a-968e-3114576dd1bf","resolution":{"observed_at":"2026-08-11T16:59:58.847190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.459229Z","title":"Learning with kernels: support vector machines, regularization, optimization, and beyond","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.459229Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:e24da8fb755827e5bc855751a0fd9a6667eec8fe56d1eb1b5904db213f3d479c","observation_id":"ae3a0da4-4863-453b-a533-92275db7860f","resolution":{"observed_at":"2026-08-11T16:59:58.459229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.798915Z","title":"Information flow in deep neural networks","venue":null,"work_id":"cb44ae5b-81e0-49bf-9058-8f96c5ffcb1e","year":2022},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.465207Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:6fa3a31ded7923e32eb42ae334dafab3e7748e1cc0a0a04fbc6305fe635ea6a9","observation_id":"41e8e436-f8ac-4c0d-bcdc-6bd843e484dd","resolution":{"observed_at":"2026-08-11T16:59:58.804592Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.777439Z","title":"To compress or not to compress—self-supervised learning and information theory: A review","venue":null,"work_id":"0483acca-8d56-4474-9a6f-33e979b58d25","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.471525Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:a75455f4bd6140f7f1a379f14d8bf9a485266e2361b41fb53c8bd1baf7cd4d2b","observation_id":"02c0c162-acfe-4451-8762-ff7390af7e5c","resolution":{"observed_at":"2026-08-11T16:59:58.783971Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.754645Z","title":"Opening the black box of deep neural networks via information","venue":null,"work_id":"82818d21-98db-4a48-8b8f-74dd7296afb0","year":2019},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.478715Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:f12ae0731b10d4001aabb4a87434290f2545c593bf436694d45e6f6fb71aa122","observation_id":"3f88e32a-defe-466b-9dd6-c16ad326b499","resolution":{"observed_at":"2026-08-11T16:59:58.760557Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.735514Z","title":"An information theory perspective on variance-invariance-covariance regularization","venue":null,"work_id":"6c6bf481-4d37-4936-991b-c83213c6cfbe","year":2023},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.485928Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:bcf1e60cf473e811ae0d73a21334d906ee9236c9460b0e05d70671e5a9c19c94","observation_id":"57eefbb0-a783-4e84-b6ee-1bb622acd7dc","resolution":{"observed_at":"2026-08-11T16:59:58.741017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.718983Z","title":"DiME : Maximizing mutual information by a difference of matrix-based entropies","venue":null,"work_id":"2e2eab74-d1d9-456f-b63f-b276cf700950","year":2023},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.492162Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:2413cd8cf1ec2cdf98ec382b333497cf940e39d849a961fcae8189e39f9ce275","observation_id":"348dd29d-84f1-486d-bcdc-a0cc1c2a0206","resolution":{"observed_at":"2026-08-11T16:59:58.724194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.696149Z","title":"FroSSL : Frobenius norm minimization for self-supervised learning","venue":null,"work_id":"26865ad6-5c6a-4b7b-8451-c1aad1607112","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.497329Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:5bec69b2852c8f03759a3999e7de4a7c6a950047aebf0833cd23e8483a56d24c","observation_id":"d7ebeb4c-b577-4205-9341-f1d8853a1e02","resolution":{"observed_at":"2026-08-11T16:59:58.703237Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.675177Z","title":"LiDAR : Sensing linear probing performance in joint embedding ssl architectures","venue":null,"work_id":"c53ac5c4-bc73-4df8-a8aa-10f4366e5e80","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.503009Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:e40cf9e1c41161dd50c83e301f2597f6bb000f0aa7dd6cfc6651ef5aea813daa","observation_id":"ae13b451-82a5-4cf8-bf56-4ca31b96eeb6","resolution":{"observed_at":"2026-08-11T16:59:58.681102Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.656480Z","title":"Attention is all you need","venue":null,"work_id":"4b218554-4546-4ec5-96a4-33f9c58da0f2","year":2017},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.508265Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:5d1aa4b644b630d13fb511c06473ca745767fbc9e1b00133442a3fd20cc1cbe8","observation_id":"e95cfbbb-56f9-4b33-ac31-3340c17a7f91","resolution":{"observed_at":"2026-08-11T16:59:58.662687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.637440Z","title":"Ai medical chatbot dataset, 2024","venue":null,"work_id":"49b3498d-f768-4c70-9080-0790d0671299","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.513078Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:236c27204ca184217ca9e3927d4b5fbadb816f2e9d8aa4646361d9316404be5f","observation_id":"8960f90a-2d51-4115-bf7e-2a277083e56e","resolution":{"observed_at":"2026-08-11T16:59:58.642774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.618216Z","title":"Large language model evaluation via matrix entropy","venue":null,"work_id":"b30a396b-1eb3-4525-b064-9362cc15b055","year":2024},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.518797Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:6514a8e9f2d5eb97619ca2f3b7580bafc67bc117289d18a6e33a0b2c57497a5f","observation_id":"9dec3861-1cbc-40b0-810e-51971eab37d2","resolution":{"observed_at":"2026-08-11T16:59:58.623690Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.595144Z","title":"Understanding neural networks with logarithm determinant entropy estimator","venue":null,"work_id":"cb59e419-bcf6-4088-8c5e-dadb456588b3","year":2021},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.524513Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:40fdc8ca2decf60942e37c2e9d0b78ee9b894860bf40f15274a44ba6cabeda30","observation_id":"dea4c476-7c63-4585-a548-76eadfb7caaf","resolution":{"observed_at":"2026-08-11T16:59:58.603144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T16:59:58.529650Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T16:59:58.529650Z"},"links":{"citing_paper":"/paper/2412.09563"},"observation_digest":"sha256:d7ab585f7852111cb42a15855a123337cdc8d885b5dba3c1a4f0785a847f110b","observation_id":"968f44f2-133b-4cc5-b88e-ce9a95b62156","resolution":{"observed_at":"2026-08-11T16:59:58.529650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.09563","last_updated":"2024-12-12T18:48:51Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-14T07:28:27.115791Z","submitted_at":"2024-12-12T18:48:51Z","title":"Does Representation Matter? Exploring Intermediate Layers in Large Language Models"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":7,"verified_exact":0,"verified_fuzzy":39},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 19 inbound Pith citation observations for arXiv:2412.09563."}