{"as_of":"2026-08-08T12:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3a30cef64275bd2afc6ba81117d4d92bc0971fd32d36e602f00f5d7e65965372","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:21:00.978836Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-06-29T08:23:15.195100Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-08-07T14:21:00.978836Z","title":"In-context convergence of transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19531","last_updated":"2025-05-26T05:33:26Z","snapshot_observed_at":"2026-08-08T07:05:10.715675Z","submitted_at":"2025-05-26T05:33:26Z","title":"Minimalist Softmax Attention Provably Learns Constrained Boolean Functions","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:21:00.978836Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2505.19531"},"observation_digest":"sha256:093e933486264316f6356cf22747f436de2f8e47fff5b77b5f5137a520396e86","observation_id":"56df5c5a-39b4-4178-b882-02195e1018e8","resolution":{"observed_at":"2026-08-07T14:21:00.978836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-08-07T12:46:35.756325Z","title":"In-context convergence of transformers.arXiv preprint arXiv:2310.05249, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23683","last_updated":"2025-05-29T17:22:00Z","snapshot_observed_at":"2026-08-07T21:59:35.039840Z","submitted_at":"2025-05-29T17:22:00Z","title":"Learning Compositional Functions with Transformers from Easy-to-Hard Data","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:46:35.756325Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2505.23683"},"observation_digest":"sha256:204bcf82b6a75f0113bf65f669400cf205ed2b7ff8b2d9e6cedf03dd40b8bb8a","observation_id":"7a1ba3e9-0933-4e24-b9c2-4b1e1948cc63","resolution":{"observed_at":"2026-08-07T12:46:35.756325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-08-06T16:37:02.984306Z","title":"In-context convergence of transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.13540","last_updated":"2025-07-30T01:51:41Z","snapshot_observed_at":"2026-08-07T22:00:27.833618Z","submitted_at":"2025-07-17T21:19:32Z","title":"Provable Low-Frequency Bias of In-Context Learning of Representations","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T16:37:02.984306Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2507.13540"},"observation_digest":"sha256:bc99ef663b73879969ae12636edd298aade7d1320a334e46eeea0dad7cbb89c6","observation_id":"b0af5446-026e-47f2-8d34-93a54cd36b13","resolution":{"observed_at":"2026-08-06T16:37:02.984306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":"2310.05249","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-06-29T08:23:15.195100Z","title":"In-context convergence of transformers","venue":null,"work_id":"a7cfc4fc-1c75-46a4-a2cf-2ef227e93641","year":2023},"citing_paper":{"arxiv_id":"2508.00901","last_updated":"2026-05-18T13:04:24Z","snapshot_observed_at":"2026-08-02T13:13:12.421550Z","submitted_at":"2025-07-28T17:24:57Z","title":"Provable Knowledge Acquisition and Extraction in One-Layer Transformers","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T23:05:56.687644Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2508.00901"},"observation_digest":"sha256:7d7824405bb3b5a6263956b914a8f76c2f4e73baf6ace179ee13a26ee97ab50b","observation_id":"c79b9456-d1d4-4a60-80d9-326a67f33907","resolution":{"observed_at":"2026-05-21T23:10:44.840921Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-08-03T20:57:10.892670Z","title":"In-context convergence of transformers, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.17852","last_updated":"2026-08-06T09:30:47Z","snapshot_observed_at":"2026-08-08T11:14:14.321947Z","submitted_at":"2025-11-22T00:38:43Z","title":"Transformers with RL or SFT Provably Learn Sparse Boolean Functions, But Differently","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-03T20:57:10.892670Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2511.17852"},"observation_digest":"sha256:961c6639a095722c79c994ba0c2945dfba86c6ae482366b0753ef1b7bc3636ee","observation_id":"e8f8ed13-86cc-4da2-a847-f6c33fadc633","resolution":{"observed_at":"2026-08-03T20:57:10.892670Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-08-02T23:11:53.755631Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.14872","last_updated":"2026-06-29T01:04:09Z","snapshot_observed_at":"2026-08-02T23:11:47.613570Z","submitted_at":"2026-02-16T16:03:08Z","title":"On the Emergence of Implicit Curriculum in RLVR Learning Dynamics","version":3},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T23:11:53.755631Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2602.14872"},"observation_digest":"sha256:6972c1f70d94c7fe103e358810abaaf93d47fb53557f12c79c9c71b753270407","observation_id":"a5e3cc5d-f6b7-4ab6-bee8-b0226dd0272d","resolution":{"observed_at":"2026-08-02T23:11:53.755631Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":"2310.05249","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-06-29T08:23:15.195100Z","title":"In-context convergence of transformers","venue":null,"work_id":"a7cfc4fc-1c75-46a4-a2cf-2ef227e93641","year":2023},"citing_paper":{"arxiv_id":"2604.06440","last_updated":"2026-04-07T20:28:24Z","snapshot_observed_at":"2026-08-04T19:54:31.349994Z","submitted_at":"2026-04-07T20:28:24Z","title":"Visual prompting reimagined: The power of the Activation Prompts","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-05-10T18:52:10.770345Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2604.06440"},"observation_digest":"sha256:b7a577ccec4110a592843d7dc7c6fb6e606859d8608422b28fc915dc0896dd5b","observation_id":"5b64748e-bcdc-4139-ad40-bfd92f1d46ac","resolution":{"observed_at":"2026-05-10T23:45:53.716450Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":"2310.05249","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-06-29T08:23:15.195100Z","title":"In-context convergence of transformers","venue":null,"work_id":"a7cfc4fc-1c75-46a4-a2cf-2ef227e93641","year":2023},"citing_paper":{"arxiv_id":"2604.10946","last_updated":"2026-04-13T03:37:08Z","snapshot_observed_at":"2026-07-06T22:59:27.499664Z","submitted_at":"2026-04-13T03:37:08Z","title":"Learning to Adapt: In-Context Learning Beyond Stationarity","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-10T16:30:36.771589Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2604.10946"},"observation_digest":"sha256:3a7c774fd3b4587d7899b11542c5e6dbe5c149a5a81e78f96f5b005118780464","observation_id":"5276d4e6-4380-427d-8037-a1fbe3e10b93","resolution":{"observed_at":"2026-05-11T08:45:59.365058Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":"2310.05249","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-06-29T08:23:15.195100Z","title":"In-context convergence of transformers","venue":null,"work_id":"a7cfc4fc-1c75-46a4-a2cf-2ef227e93641","year":2023},"citing_paper":{"arxiv_id":"2604.12817","last_updated":"2026-04-14T14:43:55Z","snapshot_observed_at":"2026-07-06T23:00:56.449281Z","submitted_at":"2026-04-14T14:43:55Z","title":"Understanding and Improving Continuous Adversarial Training for LLMs via In-context Learning Theory","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T15:54:59.122635Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2604.12817"},"observation_digest":"sha256:f027e95bc34db7937d398d41a6e39c5e8e8ae78e515cd08cafa333946851e2a4","observation_id":"66504344-a0c7-4ddb-ad28-f988b7162e35","resolution":{"observed_at":"2026-05-11T09:36:10.407208Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":"2310.05249","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-06-29T08:23:15.195100Z","title":"In-context convergence of transformers","venue":null,"work_id":"a7cfc4fc-1c75-46a4-a2cf-2ef227e93641","year":2023},"citing_paper":{"arxiv_id":"2604.21056","last_updated":"2026-04-22T19:59:20Z","snapshot_observed_at":"2026-07-06T23:07:41.856444Z","submitted_at":"2026-04-22T19:59:20Z","title":"Radiomics-Guided Vision Transformers for Survival Analysis","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-09T22:13:09.414881Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2604.21056"},"observation_digest":"sha256:480663461eaaf953dd1e40a9c2e7e25401da3b234f0d0d62656fdb9fcd77d9a5","observation_id":"4860c376-9116-4567-b88d-4f50b8de023d","resolution":{"observed_at":"2026-05-09T22:49:16.199333Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":"2310.05249","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-06-29T08:23:15.195100Z","title":"In-context convergence of transformers","venue":null,"work_id":"a7cfc4fc-1c75-46a4-a2cf-2ef227e93641","year":2023},"citing_paper":{"arxiv_id":"2605.30323","last_updated":"2026-05-28T17:56:54Z","snapshot_observed_at":"2026-08-01T08:56:52.622755Z","submitted_at":"2026-05-28T17:56:54Z","title":"In-Context Reward Adaptation for Robust Preference Modeling","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-29T08:19:55.177440Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2605.30323"},"observation_digest":"sha256:7d5bbc348f0a3cd24dd2b7f3b2368fdf668a80c1ea4ec16a284b0da0b3498dc0","observation_id":"c0ccc237-16b5-40b4-9716-816cd500e278","resolution":{"observed_at":"2026-06-29T08:23:15.196633Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-08-02T05:49:31.338698Z","title":"arXiv preprint arXiv:2310.05249 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13246","last_updated":"2026-08-01T19:18:42Z","snapshot_observed_at":"2026-08-07T16:33:22.195520Z","submitted_at":"2026-07-14T20:21:38Z","title":"Reassessing Muon for Matrix Factorization","version":1},"reference_index":112,"source":"arxiv_source","source_observed_at":"2026-08-02T05:49:31.338698Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2607.13246"},"observation_digest":"sha256:97da36ac5af636994d0838c73d52e9d72fa460899956ebcdeeb1054550cd35a2","observation_id":"f239143b-49c9-4c9c-88a2-c40ce8961772","resolution":{"observed_at":"2026-08-02T05:49:31.338698Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05249","snapshot_observed_at":"2026-08-04T04:23:05.536649Z","title":"arXiv preprint arXiv:2310.05249 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13246","last_updated":"2026-08-01T19:18:42Z","snapshot_observed_at":"2026-08-07T16:33:22.195520Z","submitted_at":"2026-07-14T20:21:38Z","title":"Reassessing Muon for Matrix Factorization","version":2},"reference_index":115,"source":"arxiv_source","source_observed_at":"2026-08-04T04:23:05.536649Z"},"links":{"cited_paper":"/paper/2310.05249","citing_paper":"/paper/2607.13246"},"observation_digest":"sha256:c5f22b7801c560d2d62200c0a8d9ee32d89a0d59b45cdd6fad1d48dae36e42d8","observation_id":"a92da5a2-e466-4818-ba04-85eb92ffbe5d","resolution":{"observed_at":"2026-08-04T04:23:05.536649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2310.05249/citation-record","integrity":"/paper/2310.05249/integrity","json":"/paper/2310.05249/citation-record.json","paper":"/paper/2310.05249"},"outbound":[],"paper":{"arxiv_id":"2310.05249","last_updated":"2023-10-08T17:55:33Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T16:29:32.059905Z","submitted_at":"2023-10-08T17:55:33Z","title":"In-Context Convergence of Transformers"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2310.05249."}