{"as_of":"2026-08-09T10:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b170e085da723d3f906d1f447e0caa7d19bdbabadb122a3b169cddff181a7614","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T20:12:20.003565Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T04:14:18.393326Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.05164","snapshot_observed_at":"2026-08-03T04:14:18.393326Z","title":", Bietti, A","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.05725","last_updated":"2026-06-03T16:40:26Z","snapshot_observed_at":"2026-08-03T04:14:09.367178Z","submitted_at":"2026-02-05T14:49:40Z","title":"Muon in Associative Memory Learning: Training Dynamics and Scaling Laws","version":3},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-03T04:14:18.393326Z"},"links":{"cited_paper":"/paper/2502.05164","citing_paper":"/paper/2602.05725"},"observation_digest":"sha256:0dc11c9add56a53f90e3161d88e8a4b8d4d3fece58090430df53c54bc000ae98","observation_id":"674a9e47-8fd6-4ebc-9cee-50ab974d3e94","resolution":{"observed_at":"2026-08-03T04:14:18.393326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2502.05164/citation-record","integrity":"/paper/2502.05164/integrity","json":"/paper/2502.05164/citation-record.json","paper":"/paper/2502.05164"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.721191Z","title":"Transformers learn to implement preconditioned gradient descent for in-context learning","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.721191Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:80a8dd2ee7e538709ff413a4224abbaf764a4a8551602e366508356e7ca8661f","observation_id":"91004943-45a4-491a-8a50-1b85437a1f2e","resolution":{"observed_at":"2026-08-08T20:12:19.721191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.809278Z","title":"What learning algorithm is in-context learning? investigations with linear models","venue":null,"work_id":"f12df134-135c-483d-ba57-861acae0ee9c","year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.727883Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:475bab41bd82bbdd4e03b24b26fa4c5745e3dea287665040864e66d3293a805e","observation_id":"2877f911-2b69-4805-8814-c2bb08c1b3f4","resolution":{"observed_at":"2026-08-08T20:12:20.814429Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15571","last_updated":"2023-03-09T15:18:40Z","snapshot_observed_at":"2026-08-08T19:32:58.342274Z","submitted_at":"2022-09-30T16:30:31Z","title":"Building Normalizing Flows with Stochastic Interpolants","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15571","snapshot_observed_at":"2026-08-08T20:12:19.733758Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.733758Z"},"links":{"cited_paper":"/paper/2209.15571","citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:69821def5ff236167ac57e7a8b7b56a8cc4f41ed21d32d36f8a8077de4ee623b","observation_id":"b6c0baf3-5fc8-421b-aabb-2ce801e5d6a2","resolution":{"observed_at":"2026-08-08T20:12:19.733758Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.791968Z","title":"Learning patterns and pattern sequences by self-organizing nets of threshold elements","venue":null,"work_id":"693395af-3600-420e-811f-cbdf7edd4ecd","year":1972},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.740649Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:9b68ac07d4d388f5bbd03a21f0d1ce7722d717ef62e787fda56cd7ac7f9abdc2","observation_id":"6ae27e66-9b13-48ee-ab10-839fb02b8660","resolution":{"observed_at":"2026-08-08T20:12:20.798226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.745757Z","title":"In search of dispersed memories: Generative diffusion models are associative memory networks","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.745757Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:dc2f8ac087510c5a21b7b68e65f873a48e70c7b623a64a02cb1f8b3675c11393","observation_id":"4d8c0977-5f99-4bdb-84ac-672326f4985e","resolution":{"observed_at":"2026-08-08T20:12:19.745757Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.751221Z","title":"J., Gutfreund, H., and Sompolinsky, H","venue":null,"work_id":null,"year":1985},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.751221Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:42e365984c5d3f1e0c3daa12536f85c23efe5f50a84670418ddb04fa5bdcf967","observation_id":"0224f3c6-1bb8-4b94-894e-3915ce98ea3b","resolution":{"observed_at":"2026-08-08T20:12:19.751221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.773730Z","title":"M., Castillo, I","venue":null,"work_id":"7d476920-1462-4e50-a427-ed5fae815db8","year":2003},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.759533Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:9827c5f8d241464c20837d9a737fffa1535b4d813bdff5aaabd96667ceb83ca8","observation_id":"def250aa-c5fc-40f6-a925-0ce3c81078ee","resolution":{"observed_at":"2026-08-08T20:12:20.779421Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.765137Z","title":"D., Dhariwal, P., Neelakantan, A., Shyam, P., Sastry, G., Askell, A., et al","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.765137Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:c8ad3d4e022b4bec506b8d9d249f1b7c97ff3aef4d304f415c5b43d38719da5e","observation_id":"8cf6c370-5ab8-4e73-aa2d-67bb43ad5a0d","resolution":{"observed_at":"2026-08-08T20:12:19.765137Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.744538Z","title":"Skyformer: Remodel self-attention with gaussian kernel and nyström method","venue":null,"work_id":"ec0fee7d-c643-4bd0-8652-81a433a35264","year":2021},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.771392Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:c669bd025f83ce42760b4d5e92ae35b12b0693b0c24c7cbcc1d00720f29d267f","observation_id":"c513ae5b-17af-4014-9276-548b8989ca39","resolution":{"observed_at":"2026-08-08T20:12:20.750265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.776643Z","title":"M., Likhosherstov, V., Dohan, D., Song, X., Gane, A., Sarlos, T., Hawkins, P., Davis, J","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.776643Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:dd43397f7cc121b1549a6f4a7d861ac64de4726b5790c6cb04312703fefa007f","observation_id":"3ff74433-c413-4b49-a643-c5be97014610","resolution":{"observed_at":"2026-08-08T20:12:19.776643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10559","last_updated":"2023-05-15T11:45:12Z","snapshot_observed_at":"2026-08-09T08:03:27.441735Z","submitted_at":"2022-12-20T18:58:48Z","title":"Why Can GPT Learn In-Context? Language Models Implicitly Perform Gradient Descent as Meta-Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10559","snapshot_observed_at":"2026-08-08T20:12:19.783838Z","title":"Why can gpt learn in-context? language models implicitly perform gradient descent as meta-optimizers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.783838Z"},"links":{"cited_paper":"/paper/2212.10559","citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:720a9071a3a64d36074533ecb84bc19b11c66ad7e65fa0274be8f996bc7f65ee","observation_id":"13b5fa6c-41bf-43a1-8b11-d7a44164c3ca","resolution":{"observed_at":"2026-08-08T20:12:19.783838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.716348Z","title":"On a model of associative memory with huge storage capacity","venue":null,"work_id":"909081f3-aa5a-4d0c-9d71-a3acf5414abd","year":2017},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.789943Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:087e379e986fd4019ecf2f6ead6ec815e63dec2783e8f431cc9f9e3ac2de8e79","observation_id":"3264bd70-f400-4df2-9ce7-81f0e6ae447b","resolution":{"observed_at":"2026-08-08T20:12:20.722080Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.698807Z","title":"Bert: Pre-training of deep bidirectional transformers for language understanding","venue":null,"work_id":"9ee3e53e-7dd7-462b-bf49-b753b37b713f","year":2019},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.795289Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:27c5c3a956ce306696be1e9b23d6d4192761abf04d917095d31c035d102155d6","observation_id":"aa2f8aff-c2cd-4c57-aa5a-25f824b86ae7","resolution":{"observed_at":"2026-08-08T20:12:20.704500Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.801432Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.801432Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:e0fa7a796bf791be735e2cebf1ce3afb21be7423e81a2cb83c3b1ea44fef12d6","observation_id":"b61d8712-34c0-433e-81c8-e426144f182d","resolution":{"observed_at":"2026-08-08T20:12:19.801432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.670078Z","title":null,"venue":null,"work_id":"7f863e7f-bdf5-4cae-b9da-641d63c4a307","year":1993},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.807071Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:707780c067386019cec8739c2c61c25cf9450b6026e4069e158c4ad1ccaab453","observation_id":"baa23eab-c0b2-4263-b57b-9fb508fad702","resolution":{"observed_at":"2026-08-08T20:12:20.675115Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01066","last_updated":"2023-08-11T19:27:58Z","snapshot_observed_at":"2026-08-08T13:08:09.726847Z","submitted_at":"2022-08-01T18:01:40Z","title":"What Can Transformers Learn In-Context? A Case Study of Simple Function Classes","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01066","snapshot_observed_at":"2026-08-08T20:12:19.813203Z","title":"S., and Valiant, G","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.813203Z"},"links":{"cited_paper":"/paper/2208.01066","citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:805b481fc5fe11adc09e77dae8cb7058afb2babb36d42e1b41514db4637395f6","observation_id":"e311b2af-b77d-4843-8f8d-9661f34e8b51","resolution":{"observed_at":"2026-08-08T20:12:19.813203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.654105Z","title":"Sampling with flows, diffusion, and autoregressive neural networks from a spin-glass perspective","venue":null,"work_id":"6ae4c702-b8a8-42d5-b12f-332de86fb8fd","year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.819532Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:6909bf925aaf22355dcd847868e76189f4a08f7825dafa261f1f11bd08e6c766","observation_id":"769bf4ae-bd6c-4187-9632-39bdccf7310e","resolution":{"observed_at":"2026-08-08T20:12:20.659317Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.637898Z","title":null,"venue":null,"work_id":"1fe8badf-8e8a-4558-9442-c8cc23788dc5","year":2007},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.825224Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:035b8f6a0c52bebb593442409f5622fb67de718513eea73bfad6570b1e95884c","observation_id":"cfc00335-dc6e-407c-bf5c-92308aee9f33","resolution":{"observed_at":"2026-08-08T20:12:20.642930Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.830090Z","title":"Probability inequalities for sums of bounded random variables","venue":null,"work_id":null,"year":1994},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.830090Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:5e28bbaa329c42c9c1fb6c051f9338d41f8e986cc70b094f351f3dece8110bff","observation_id":"f07c8e26-3afb-48ab-b07d-3139de192457","resolution":{"observed_at":"2026-08-08T20:12:19.830090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.611893Z","title":"H., Zaki, M., and Krotov, D","venue":null,"work_id":"fa4cea02-89fa-4a6e-8476-20d15798983b","year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.834946Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:da63c62f416478bcb460ddc0b5cdd2d99e0a029f17da5587e9af13b4c40743f4","observation_id":"539c970a-ebe3-4f4e-bb01-a3b8df0df8fd","resolution":{"observed_at":"2026-08-08T20:12:20.616978Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.595053Z","title":"H., Zaki, M","venue":null,"work_id":"7497231d-24f5-437d-8a99-19a28feff0ad","year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.840519Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:c5dadefa786e9c2c52207f5ab22ada08a9f4049270414218a1cc3be178445af1","observation_id":"51534cf1-08d0-4c05-b897-13622a9d4f7a","resolution":{"observed_at":"2026-08-08T20:12:20.600289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.578639Z","title":"H., Strobelt, H., Ram, P., and Krotov, D","venue":null,"work_id":"ea84682f-4a89-4279-8c87-2fbd4fd8e636","year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.845924Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:84e840a7d8440b07096068142cc23c044f68fa96a75fc5ba271d02ae2880dd28","observation_id":"a510701a-a36a-413f-8e47-a9b94bf78bca","resolution":{"observed_at":"2026-08-08T20:12:20.583798Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.16750","last_updated":"2024-05-28T11:46:33Z","snapshot_observed_at":"2026-08-09T03:14:54.246278Z","submitted_at":"2023-09-28T17:57:09Z","title":"Memory in Plain Sight: Surveying the Uncanny Resemblances of Associative Memories and Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2309.16750","snapshot_observed_at":"2026-08-08T20:12:19.851996Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.851996Z"},"links":{"cited_paper":"/paper/2309.16750","citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:80b8bf2379103e4efd098b4ab10ea633f3fcddfddafdbe62dd117f7ac1c2147b","observation_id":"a11133fd-e21e-40ec-890a-9eb59bec96b3","resolution":{"observed_at":"2026-08-08T20:12:19.851996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.858163Z","title":null,"venue":null,"work_id":null,"year":1982},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.858163Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:7a9f601b5edf195110a5984082136331287a36ab770387a6671bf72ed7dff2e0","observation_id":"092e970c-c195-478a-a96e-0298498cefef","resolution":{"observed_at":"2026-08-08T20:12:19.858163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.561442Z","title":"Y.-C., Yang, D., Wu, D., Xu, C., Chen, B.-Y., and Liu, H","venue":null,"work_id":"39429644-ef26-4b60-af75-5d90b0b10559","year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.863027Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:f64981145af73ffe5b43cf3c1473418c2c088721505625f28d2002db0a4554d0","observation_id":"fdb177ab-34ce-4722-9b26-74adebe7242b","resolution":{"observed_at":"2026-08-08T20:12:20.567487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.868578Z","title":"Transformers are rnns: fast autoregressive transformers with linear attention","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.868578Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:cf234161a01333b5449743f6192afa0ff35adc03f36fbf47517163f62cba8d90","observation_id":"7029d907-01e2-4041-a9c6-4428812673cd","resolution":{"observed_at":"2026-08-08T20:12:19.868578Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.534504Z","title":"A new frontier for hopfield networks","venue":null,"work_id":"e428d6ac-a7db-4d69-b370-c07b80ac50b7","year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.873476Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:38ba77d34bd7f53d30551423946081591b7c50f3f61557cd9196c5494bec4f57","observation_id":"054cbaa4-8b89-43af-96d7-49798184ca88","resolution":{"observed_at":"2026-08-08T20:12:20.540752Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.518730Z","title":"and Hopfield, J","venue":null,"work_id":"b8cbff2d-f6a1-4a03-9763-1b6f1e150647","year":2016},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.879407Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:2fd5e068cc3681ccf824af3adcb840f2f57644e9c9af534ff606426e4db9129e","observation_id":"01f9dcb1-d452-4d48-b8c8-52095f87deae","resolution":{"observed_at":"2026-08-08T20:12:20.523648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.500646Z","title":"and Hopfield, J","venue":null,"work_id":"52847c59-8d06-4aaa-a58c-6518b055cf6e","year":2021},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.885552Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:9cdadfca3f75b2c822bfbbaf714d76bf80df07b4cf54eddcf2b38926c1f0367c","observation_id":"09da571a-f368-4b7c-8335-e9094e7ca383","resolution":{"observed_at":"2026-08-08T20:12:20.506949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.484517Z","title":null,"venue":null,"work_id":"dde23295-da6d-4004-89df-55905d200aee","year":1974},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.890725Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:04d1683daad76109ddc966fe2ad72d7063d14b980e5f3768e232c67e04b0e96f","observation_id":"90a63058-3566-4740-9277-99d52c383bbc","resolution":{"observed_at":"2026-08-08T20:12:20.489411Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.468102Z","title":"Probability theory i","venue":null,"work_id":"7500c4a0-bac3-4ec3-beac-04192e9fd037","year":1977},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.895696Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:3a39412e20aff364db0185b4c799d962683b9aeeb0d5ec891183836dd16af3d6","observation_id":"2aeac261-eae3-4d6d-8baa-3f6302b93b13","resolution":{"observed_at":"2026-08-08T20:12:20.473411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.900776Z","title":"and M\\'ezard, M","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.900776Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:35fff4a723ed200ab8634b3930c16eeec1fe9f413ffb9d928865c891fa1f275d","observation_id":"ac48d440-57a3-4191-88df-e5a134d4d0ba","resolution":{"observed_at":"2026-08-08T20:12:19.900776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.450686Z","title":"Universal hopfield networks: A general framework for single-shot associative memory models","venue":null,"work_id":"98d0c99b-5f3b-4ce3-8c74-037ed822ca40","year":2022},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.905910Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:9339b4a246031d3cc9ee958f3d563508392239bd697deef99b9b255817b5297b","observation_id":"c0fdd48e-f83b-4340-9898-92dd80e36e0d","resolution":{"observed_at":"2026-08-08T20:12:20.455811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.434304Z","title":"Associatron-a model of associative memory","venue":null,"work_id":"7791e6df-961b-4edf-b603-ebdfd9577f7a","year":1972},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.910946Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:5d4b5653fcb7cf0f3938b30770bf332cfddfa1ba03a3ac0b070aa4040cae0929","observation_id":"970f2bd5-9310-4143-9bbe-c3408fa135b5","resolution":{"observed_at":"2026-08-08T20:12:20.439551Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.418170Z","title":"J., Ambrogioni, L., and Krotov, D","venue":null,"work_id":"7055f975-b7da-4b18-b4c5-266d33711551","year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.916303Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:f99a29e14c36f531636b1ea9d0decfc63a25a0ef29a20347706af7d33fcde5ab","observation_id":"db9ce9da-d70e-48da-aa4c-2022d15e0e90","resolution":{"observed_at":"2026-08-08T20:12:20.423397Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.402506Z","title":"P., Kopp, M","venue":null,"work_id":"d091144f-3a68-404f-9d4b-7d32bbdeddb8","year":2021},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.922685Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:8e0997311d233cd7772a72d8a20de94528ce64beefbeba909dbc404aca34609a","observation_id":"2e5c9f53-790f-4349-956c-26e1ce643618","resolution":{"observed_at":"2026-08-08T20:12:20.407286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.382432Z","title":"The mechanistic basis of data dependence and abrupt learning in an in-context classification task","venue":null,"work_id":"fd3210e7-2fba-4761-bb4d-f26f447066f0","year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.927878Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:369bdac155419ff9bc297d524b1a919d8b88142c82efadd3c7d6cd2cf239fbe0","observation_id":"5eb13efe-e8cc-40f4-b31c-d6163978bcf3","resolution":{"observed_at":"2026-08-08T20:12:20.389476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19244","last_updated":"2023-10-30T03:22:54Z","snapshot_observed_at":"2026-07-06T16:40:16.152421Z","submitted_at":"2023-10-30T03:22:54Z","title":"High-Dimensional Statistics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.19244","snapshot_observed_at":"2026-08-08T20:12:19.933271Z","title":"and H \\\"u tter, J.-C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.933271Z"},"links":{"cited_paper":"/paper/2310.19244","citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:bb6114369bca44c8643e02f858209159a03d62aec4a792c519d05665137bb540","observation_id":"9582f500-aae4-475c-9a3a-8756dc0845f1","resolution":{"observed_at":"2026-08-08T20:12:19.933271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.363885Z","title":null,"venue":null,"work_id":"0afc0613-9e62-4f80-8c92-f463957e035b","year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.939249Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:59155229449ef703b25609ad42c6c38efbc0b09dd5657a479ebf94c4575e9729","observation_id":"325c1420-7247-4f74-85df-1c797b5220f4","resolution":{"observed_at":"2026-08-08T20:12:20.369749Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.346237Z","title":null,"venue":null,"work_id":"23aadbf7-bd1f-4203-b871-3214ecbcad13","year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.945246Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:a5600ab3386ebaa0b239c9a0f4601d80ff98c4d9b4dd7a7de5bb72343ddff146","observation_id":"38837b5d-7cd3-4004-81c9-46d27159bcdc","resolution":{"observed_at":"2026-08-08T20:12:20.351319Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.328874Z","title":"and Zilman, A","venue":null,"work_id":"09e86186-e62e-434e-888b-06f580473d08","year":2021},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.952676Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:a75e45585b2011f0d31b0249cef9e65f49a136073c366eac0721d880386404b4","observation_id":"bbe52dc3-773d-4cc9-a00a-92713f5de50b","resolution":{"observed_at":"2026-08-08T20:12:20.334330Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.13971","last_updated":"2023-02-27T17:11:15Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-02-27T17:11:15Z","title":"LLaMA: Open and Efficient Foundation Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2302.13971","snapshot_observed_at":"2026-08-08T20:12:19.957739Z","title":"Llama: Open and efficient foundation language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.957739Z"},"links":{"cited_paper":"/paper/2302.13971","citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:726b147ed0b376d6d1b58845e2ea48c730df85bbfa902219fddcc08b391ab714","observation_id":"821c45df-7062-4b54-927d-720e3278b637","resolution":{"observed_at":"2026-08-08T20:12:19.957739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.312161Z","title":"and Kolter, J","venue":null,"work_id":"9ca4129e-b5ef-4cb2-aa65-74a5db0c699b","year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.963489Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:d1f47ff2e3fcbfb241f66b2e1cfc4f5a569f93b454baaea5713ba7f495448e07","observation_id":"625ed1f4-5df5-48c7-ad58-e6f618dbf024","resolution":{"observed_at":"2026-08-08T20:12:20.317383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.293935Z","title":"N., Łukasz Kaiser, and Polosukhin, I","venue":null,"work_id":"a1f198bf-61a9-4418-ac43-2e9f1055f97a","year":2017},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.969519Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:ef906acd4360f44559fee48a4b49706f605aa1a45fb3243e3d7323ad8a1ace9a","observation_id":"38841fad-e635-4bd1-8234-6821994bd7d2","resolution":{"observed_at":"2026-08-08T20:12:20.299496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.974016Z","title":"Transformers learn in-context by gradient descent","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.974016Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:ab19c625372ccf5f13e1f49cc0f56741b06eddad4136cf9a7e4c926ba7dee8e2","observation_id":"f203ca04-c781-45fb-b34a-0e80a415dbc0","resolution":{"observed_at":"2026-08-08T20:12:19.974016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.267847Z","title":"Y.-C., Hsiao, T.-Y., and Liu, H","venue":null,"work_id":"a995ed0a-5515-4f1a-a82a-73f399703acb","year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.978627Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:ca2f76da5465595bb048c6bc6f9e1f868f86206c0a133b71b51e3f44dacfc146","observation_id":"5f3b6b87-d9b7-470c-b9f5-60749dc1f2c0","resolution":{"observed_at":"2026-08-08T20:12:20.272991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.17346","last_updated":"2023-12-28T20:26:23Z","snapshot_observed_at":"2026-08-09T03:14:51.041161Z","submitted_at":"2023-12-28T20:26:23Z","title":"STanHop: Sparse Tandem Hopfield Model for Memory-Enhanced Time Series Prediction","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.17346","snapshot_observed_at":"2026-08-08T20:12:19.983057Z","title":"Y.-C., Li, W., Chen, B.-Y., and Liu, H","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.983057Z"},"links":{"cited_paper":"/paper/2312.17346","citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:cdd9a1b003f4917cf889bdc3c61360a96409547dd9047df6016d92905ef33241","observation_id":"17a42cd6-5863-467e-a1a3-180683bd7195","resolution":{"observed_at":"2026-08-08T20:12:19.983057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.248680Z","title":null,"venue":null,"work_id":"4319dd9d-0c1b-4d09-a19d-88c87ad4fad9","year":2024},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.987968Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:d87fbf12915e0f7d9b6d591ae16eb7952449eee4b57241cdafb924ece4f8f857","observation_id":"7f0d2761-8324-43c4-bbc1-f32650ad520a","resolution":{"observed_at":"2026-08-08T20:12:20.255153Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.992948Z","title":"@esa (Ref","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.992948Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:ac41e370b4df00a50cead81685907f3fa3228e83171665da34400b80401c4a0b","observation_id":"5754da27-3fab-401a-9095-c25a02eca7e7","resolution":{"observed_at":"2026-08-08T20:12:19.992948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:19.998349Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:19.998349Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:9961633a01c8ecd39567668bbad2ae930bc9fa4b2814111fd273d1e18bd6b507","observation_id":"e2831b3b-3e81-4625-9336-08314362cf70","resolution":{"observed_at":"2026-08-08T20:12:19.998349Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T20:12:20.003565Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-08T20:12:20.003565Z"},"links":{"citing_paper":"/paper/2502.05164"},"observation_digest":"sha256:3addad9d57e34c76286026f914b7b6ee265b5e55a49044bd4b6d0676a71e51ed","observation_id":"55189220-1631-4dfa-9c08-b2061ffb4597","resolution":{"observed_at":"2026-08-08T20:12:20.003565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.05164","last_updated":"2025-06-06T05:00:45Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-09T09:20:36.154846Z","submitted_at":"2025-02-07T18:48:25Z","title":"In-context denoising with one-layer transformers: connections between attention and associative memory retrieval"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":27,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 1 inbound Pith citation observation for arXiv:2502.05164."}