{"as_of":"2026-08-09T08:15:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e22b8492e4c1a55d1534e332bde77cc1f2d0e7e62dccb5ea707fc6ff350b04b0","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":16,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T17:13:25.873634Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T13:29:50.992154Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-08-08T17:13:25.873634Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06007","last_updated":"2025-02-09T19:51:58Z","snapshot_observed_at":"2026-08-08T17:00:51.532628Z","submitted_at":"2025-02-09T19:51:58Z","title":"Transformers versus the EM Algorithm in Multi-class Clustering","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-08T17:13:25.873634Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2502.06007"},"observation_digest":"sha256:cbab8eb801fd2263f2769a59c4a348735f089a9cf21ebd92ad9ae063d912261b","observation_id":"c1446f92-28fc-456e-9393-cb813de2747d","resolution":{"observed_at":"2026-08-08T17:13:25.873634Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-08-07T20:21:58.426007Z","title":"Trained transformers learn linear models in-context","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09844","last_updated":"2025-05-28T00:52:33Z","snapshot_observed_at":"2026-08-09T01:29:51.349548Z","submitted_at":"2025-02-14T01:06:15Z","title":"Solving Empirical Bayes via Transformers","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T20:21:58.426007Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2502.09844"},"observation_digest":"sha256:ce6490ef2641f3598ed7304fddee380bb14e941913e88889de51bafe4cc196c0","observation_id":"5bb06c04-b450-4bef-9b05-d4e01e6abfb9","resolution":{"observed_at":"2026-08-07T20:21:58.426007Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-08-07T15:11:02.235661Z","title":"Tra ined transformers learn linear models in-context","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16284","last_updated":"2025-05-22T06:26:28Z","snapshot_observed_at":"2026-08-07T22:03:10.571335Z","submitted_at":"2025-05-22T06:26:28Z","title":"Only Large Weights (And Not Skip Connections) Can Prevent the Perils of Rank Collapse","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T15:11:02.235661Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2505.16284"},"observation_digest":"sha256:0cf3e7b711c49f388be005bfa6f87734b50e8fa00d14c9479e0a2bdd7c1e52b9","observation_id":"726141bb-2a40-426a-9ef6-1ff457cecb61","resolution":{"observed_at":"2026-08-07T15:11:02.235661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-08-07T12:46:40.385953Z","title":"exact gradients","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23683","last_updated":"2025-05-29T17:22:00Z","snapshot_observed_at":"2026-08-07T21:59:35.039840Z","submitted_at":"2025-05-29T17:22:00Z","title":"Learning Compositional Functions with Transformers from Easy-to-Hard Data","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:40.385953Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2505.23683"},"observation_digest":"sha256:9f5bcd873e59184b97ed21ac2f2b2a2332bdebecc2aa57a21d4a3aeafda360e1","observation_id":"b2fc7f14-4432-4a2a-a85f-c240aa9b09e9","resolution":{"observed_at":"2026-08-07T12:46:40.385953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-08-05T22:10:17.617037Z","title":", Frei, S","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.07571","last_updated":"2025-08-19T11:54:07Z","snapshot_observed_at":"2026-08-07T21:59:26.623348Z","submitted_at":"2025-08-11T03:05:36Z","title":"Towards Theoretical Understanding of Transformer Test-Time Computing: Investigation on In-Context Linear Regression","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-05T22:10:17.617037Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2508.07571"},"observation_digest":"sha256:fb9d928cc3f9715e84071973f9c39fe3419c0b8ca8bb0b35849f008b754a440d","observation_id":"d3d42c49-58b1-4a16-ad95-623512cf4413","resolution":{"observed_at":"2026-08-05T22:10:17.617037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-08-04T13:29:32.330348Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.00399","last_updated":"2026-07-07T00:49:52Z","snapshot_observed_at":"2026-08-08T12:55:20.207266Z","submitted_at":"2025-10-01T01:25:01Z","title":"How Can Mamba Learn In Context with Outliers and Generalize Provably?","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-04T13:29:32.330348Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2510.00399"},"observation_digest":"sha256:d65a768c4cad6945990797b621a877a71e41b5817b1110c5ee4833cac80f445a","observation_id":"d8156a7f-8b4c-41ef-b776-a516f5be5b85","resolution":{"observed_at":"2026-08-04T13:29:32.330348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-08-03T20:57:13.415074Z","title":"Bartlett","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.17852","last_updated":"2026-08-06T09:30:47Z","snapshot_observed_at":"2026-08-09T08:09:35.949521Z","submitted_at":"2025-11-22T00:38:43Z","title":"Transformers with RL or SFT Provably Learn Sparse Boolean Functions, But Differently","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-03T20:57:13.415074Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2511.17852"},"observation_digest":"sha256:da97d6e65ee1dd14845da49b1c7dc28400d156c278425cd650af182b8ff207ec","observation_id":"863b275c-17af-4ea1-88a6-a8937a55992e","resolution":{"observed_at":"2026-08-03T20:57:13.415074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-08-03T17:10:09.518256Z","title":"Bartlett","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2512.10656","last_updated":"2026-06-08T08:57:35Z","snapshot_observed_at":"2026-08-03T17:10:05.838701Z","submitted_at":"2025-12-11T14:02:34Z","title":"Token Sample Complexity of Attention","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T17:10:09.518256Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2512.10656"},"observation_digest":"sha256:0424d83f8a17d6f616cfbba1b880b5e61f796d1b2fde0fe04da6e78ed39f45c6","observation_id":"21622bc8-051d-4b67-80dd-df411e07cb58","resolution":{"observed_at":"2026-08-03T17:10:09.518256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-08-02T22:19:23.982015Z","title":"Trained transformers learn linear models in-context.arXiv preprint arXiv:2306.09927, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.17743","last_updated":"2026-07-20T14:54:26Z","snapshot_observed_at":"2026-08-07T21:21:07.188072Z","submitted_at":"2026-02-19T12:37:00Z","title":"Bigger Is Safer: Provable Robustness in In-Context Learning Scales with Capacity","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-02T22:19:23.982015Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2602.17743"},"observation_digest":"sha256:be23d43deafdfc7db4bf383f04e24c562443634214840de72898276aa97c46ce","observation_id":"f2201271-7f22-4384-8742-54b34a4cdf71","resolution":{"observed_at":"2026-08-02T22:19:23.982015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":"2306.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-07-04T13:29:50.992154Z","title":"10 One for ALL: A Non-Linear Transformer can enable Cross-Domain Generalization for In-Context Reinforcement Learning A","venue":null,"work_id":"97bd2b45-875b-4672-bcad-517ff8e3c83d","year":2025},"citing_paper":{"arxiv_id":"2604.06440","last_updated":"2026-04-07T20:28:24Z","snapshot_observed_at":"2026-08-04T19:54:31.349994Z","submitted_at":"2026-04-07T20:28:24Z","title":"Visual prompting reimagined: The power of the Activation Prompts","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-10T18:52:10.770345Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2604.06440"},"observation_digest":"sha256:70f3189ad493276a230b9522a0ed9490b0393d2ebc230bedb59733e14ab4c0a8","observation_id":"619b25d3-97f2-484c-88f5-2bbf04756de9","resolution":{"observed_at":"2026-05-10T23:45:53.683652Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":"2306.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-07-04T13:29:50.992154Z","title":"10 One for ALL: A Non-Linear Transformer can enable Cross-Domain Generalization for In-Context Reinforcement Learning A","venue":null,"work_id":"97bd2b45-875b-4672-bcad-517ff8e3c83d","year":2025},"citing_paper":{"arxiv_id":"2604.10074","last_updated":"2026-04-11T07:46:15Z","snapshot_observed_at":"2026-07-06T22:58:47.599383Z","submitted_at":"2026-04-11T07:46:15Z","title":"Transformers Learn the Optimal DDPM Denoiser for Multi-Token GMMs","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-05-10T16:23:50.751356Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2604.10074"},"observation_digest":"sha256:c74ebdb3c36674aadace00196e0ee645b060c12a0c2e39fb6dc4bbd69c25513d","observation_id":"dd82a22e-8adb-450e-a7ab-3b2b72338472","resolution":{"observed_at":"2026-05-11T08:56:02.651960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":"2306.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-07-04T13:29:50.992154Z","title":"10 One for ALL: A Non-Linear Transformer can enable Cross-Domain Generalization for In-Context Reinforcement Learning A","venue":null,"work_id":"97bd2b45-875b-4672-bcad-517ff8e3c83d","year":2025},"citing_paper":{"arxiv_id":"2604.13403","last_updated":"2026-04-15T02:12:51Z","snapshot_observed_at":"2026-07-06T23:01:23.771347Z","submitted_at":"2026-04-15T02:12:51Z","title":"Why Multimodal In-Context Learning Lags Behind? Unveiling the Inner Mechanisms and Bottlenecks","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-10T13:41:37.942145Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2604.13403"},"observation_digest":"sha256:7bc4fd585862925df43d154d4b5bf577039e8915b8f73c8863ed2c125374d142","observation_id":"62c1cd92-f390-4f23-b42b-c9910c813472","resolution":{"observed_at":"2026-05-10T13:45:28.160280Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":"2306.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-07-04T13:29:50.992154Z","title":"10 One for ALL: A Non-Linear Transformer can enable Cross-Domain Generalization for In-Context Reinforcement Learning A","venue":null,"work_id":"97bd2b45-875b-4672-bcad-517ff8e3c83d","year":2025},"citing_paper":{"arxiv_id":"2605.09727","last_updated":"2026-05-10T19:52:29Z","snapshot_observed_at":"2026-07-31T17:23:23.893636Z","submitted_at":"2026-05-10T19:52:29Z","title":"One for All: A Non-Linear Transformer can Enable Cross-Domain Generalization for In-Context Reinforcement Learning","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-12T03:46:21.786972Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2605.09727"},"observation_digest":"sha256:3dce1a671d6132fc425128acf9ae5dc612c9cc37808224015e295325538d4fd2","observation_id":"adf96f5d-df37-4882-ae34-985bca3dd4b1","resolution":{"observed_at":"2026-05-12T06:56:32.047335Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":"2306.09927","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-07-04T13:29:50.992154Z","title":"10 One for ALL: A Non-Linear Transformer can enable Cross-Domain Generalization for In-Context Reinforcement Learning A","venue":null,"work_id":"97bd2b45-875b-4672-bcad-517ff8e3c83d","year":2025},"citing_paper":{"arxiv_id":"2606.26749","last_updated":"2026-06-25T08:33:34Z","snapshot_observed_at":"2026-08-01T16:00:20.311664Z","submitted_at":"2026-06-25T08:33:34Z","title":"Structure Before Collapse: Transient semantic geometry in next-token prediction","version":1},"reference_index":124,"source":"arxiv_source","source_observed_at":"2026-06-26T05:14:07.208255Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2606.26749"},"observation_digest":"sha256:b5e50923f13e959c36e5a8b721d0cccb61ec9049eb8bf87414c5ce59ec2ad993","observation_id":"04269abe-6acd-4a0e-9c06-0be4c81a5a68","resolution":{"observed_at":"2026-07-04T13:29:50.993590Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-08-01T23:43:11.185169Z","title":"2306.09927 , archiveprefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15277","last_updated":"2026-07-16T17:59:31Z","snapshot_observed_at":"2026-08-06T16:50:03.110275Z","submitted_at":"2026-07-16T17:59:31Z","title":"Partition, Prompt, Aggregate: Statistical Self-Consistency in Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-01T23:43:11.185169Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2607.15277"},"observation_digest":"sha256:7e19e30b2806e76250b7737199042d319ab9fbf7b51381b8377e6c52f03ed1b8","observation_id":"cdf6aacb-619a-46a5-ba46-6fec254b322e","resolution":{"observed_at":"2026-08-01T23:43:11.185169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.09927","snapshot_observed_at":"2026-07-31T23:52:10.128256Z","title":"arXiv preprint arXiv:2306.09927 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23333","last_updated":"2026-07-25T19:11:15Z","snapshot_observed_at":"2026-08-03T00:37:21.399146Z","submitted_at":"2026-07-25T19:11:15Z","title":"Training with (Swap) Regret Loss in a Single-Layer Self-Attention Model: A Case Study on the Probability Simplex","version":1},"reference_index":230,"source":"arxiv_source","source_observed_at":"2026-07-31T23:52:10.128256Z"},"links":{"cited_paper":"/paper/2306.09927","citing_paper":"/paper/2607.23333"},"observation_digest":"sha256:780994acebfb0c8c50593151b531c04e55ac3de8ab27d936982e9c57499c4d4f","observation_id":"fbe38d16-fb9e-447c-83a6-8ebada201829","resolution":{"observed_at":"2026-07-31T23:52:10.128256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2306.09927/citation-record","integrity":"/paper/2306.09927/integrity","json":"/paper/2306.09927/citation-record.json","paper":"/paper/2306.09927"},"outbound":[],"paper":{"arxiv_id":"2306.09927","last_updated":"2023-10-19T20:31:32Z","latest_version":3,"primary_category":"stat.ML","snapshot_observed_at":"2026-07-06T15:43:31.881201Z","submitted_at":"2023-06-16T15:50:03Z","title":"Trained Transformers Learn Linear Models In-Context"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 16 inbound Pith citation observations for arXiv:2306.09927."}