{"as_of":"2026-08-08T23:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b5ef68b059d6b88d6c6c52a3829c670a986819e6ef019e0266760285a91cef3a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":14,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":14,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":14,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":14,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:49:53.729633Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":8,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":"2311.00871","doi":"10.48550/arxiv.2311.00871","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023 , month = nov, journal =","venue":"arXiv (Cornell University)","work_id":"f96fb77a-b470-470f-b661-3b86902dcffe","year":2023},"citing_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T12:58:27.430374Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2301.00234"},"observation_digest":"sha256:93b4bf054e16ec217bf000fe08099ff541ff20487d09c59de48348c2d7fd34f1","observation_id":"62377aec-c689-4e69-9860-f75936b24e17","resolution":{"observed_at":"2026-05-12T12:58:27.531557Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-07T12:49:53.729633Z","title":"Pretraining data mixtures enable narrow model selection capabilities in trans- former models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.23378","last_updated":"2026-07-24T13:43:40Z","snapshot_observed_at":"2026-08-07T12:44:34.684960Z","submitted_at":"2025-05-29T11:58:04Z","title":"Meta-Learning Approaches for Speaker-Dependent Voice Fatigue Models","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:53.729633Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2505.23378"},"observation_digest":"sha256:04e9415667ffa5111c2ac3275926c10e4c1ae7915ba3fe655ed31e9c2a219713","observation_id":"a6396400-5d61-4d44-b894-69a32534e92b","resolution":{"observed_at":"2026-08-07T12:49:53.729633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-05T20:53:40.619277Z","title":"Todd, E., Li, M., Sharma, A","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2508.09824","last_updated":"2025-08-15T01:40:46Z","snapshot_observed_at":"2026-08-05T20:53:05.616467Z","submitted_at":"2025-08-13T13:56:01Z","title":"Reverse Convolution and Its Applications to Image Restoration","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T20:53:40.619277Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2508.09824"},"observation_digest":"sha256:1e46d78b95b9a190e73936f149f3cab64db51e80015e84ee54490c79d93c1f45","observation_id":"f45318f3-cef2-4aad-b3b3-bd89673c894c","resolution":{"observed_at":"2026-08-05T20:53:40.619277Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-04T21:11:45.526293Z","title":"Yadlowsky, L","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08184","last_updated":"2025-09-09T23:13:41Z","snapshot_observed_at":"2026-08-04T21:11:14.321955Z","submitted_at":"2025-09-09T23:13:41Z","title":"Selective Induction Heads: How Transformers Select Causal Structures In Context","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-04T21:11:45.526293Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2509.08184"},"observation_digest":"sha256:d13f32b91f5ae069c0fef15f08cd296ea8e310e2a4d9adfe147f80300fe70f9e","observation_id":"8af09c67-f019-4a48-81f4-43c641bc62c8","resolution":{"observed_at":"2026-08-04T21:11:45.526293Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-04T14:50:23.215388Z","title":"Pretraining data mixtures enable narrow model selection capabilities in transformer models.arXiv preprint arXiv:2311.00871,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.22854","last_updated":"2026-06-02T17:52:26Z","snapshot_observed_at":"2026-08-04T14:50:20.613083Z","submitted_at":"2025-09-26T19:05:45Z","title":"Train Once, Reuse Everywhere: Generalizable Implicit In-Context Learning by Routing Attention","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-04T14:50:23.215388Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2509.22854"},"observation_digest":"sha256:6c187ba3551de53654280c7676af389f210b7063ffe8b0d745d2558c19f44dad","observation_id":"6d911264-1561-445f-a98e-36f6d29df409","resolution":{"observed_at":"2026-08-04T14:50:23.215388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-04T13:15:26.228592Z","title":"Pretraining data mixtures enable narrow model selection capabilities in transformer models.arXiv preprint arXiv: 2311.00871,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.01163","last_updated":"2026-06-24T11:54:33Z","snapshot_observed_at":"2026-08-08T18:31:24.467184Z","submitted_at":"2025-10-01T17:52:29Z","title":"How Does the Pretraining Distribution Shape In-Context Learning? A Fundamental Trade-Off","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T13:15:26.228592Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2510.01163"},"observation_digest":"sha256:ec48fa6483a800fc6803114f11a03b5f724f3762c7cd9bc7fb5dc34c6fc6fdd2","observation_id":"0dce2508-c6ea-4192-bb02-c02967b538a2","resolution":{"observed_at":"2026-08-04T13:15:26.228592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-03T07:15:11.064373Z","title":"Pretraining data mixtures enable narrow model selection capabilities in transformer models.arXiv preprint arXiv:2311.00871,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.20796","last_updated":"2026-05-26T14:33:44Z","snapshot_observed_at":"2026-08-03T07:15:07.656197Z","submitted_at":"2026-01-28T17:37:28Z","title":"Dissecting Multimodal In-Context Learning: Modality Asymmetries and Circuit Dynamics in modern Transformers","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-03T07:15:11.064373Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2601.20796"},"observation_digest":"sha256:f1d4c51e68e1b9d606ba4bce985038568c3e63bad5a0da3e675040794ab8e423","observation_id":"71389871-8ebc-4a80-9203-1586c1068376","resolution":{"observed_at":"2026-08-03T07:15:11.064373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":"2311.00871","doi":"10.48550/arxiv.2311.00871","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023 , month = nov, journal =","venue":"arXiv (Cornell University)","work_id":"f96fb77a-b470-470f-b661-3b86902dcffe","year":2023},"citing_paper":{"arxiv_id":"2604.11613","last_updated":"2026-05-29T09:48:20Z","snapshot_observed_at":"2026-07-12T21:51:18.861884Z","submitted_at":"2026-04-13T15:20:41Z","title":"Symmetry Reveals Layerwise Dynamics: How Transformers Perform In-Context Classification","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T15:07:38.931464Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2604.11613"},"observation_digest":"sha256:c2f22f2ed39b3fb4c63f9acaab05236bf147400ae51b9c59d6960b1f5ea15681","observation_id":"61b97eb3-1fc5-4c03-994e-3198a975978e","resolution":{"observed_at":"2026-05-11T11:11:04.020986Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":"2311.00871","doi":"10.48550/arxiv.2311.00871","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023 , month = nov, journal =","venue":"arXiv (Cornell University)","work_id":"f96fb77a-b470-470f-b661-3b86902dcffe","year":2023},"citing_paper":{"arxiv_id":"2605.12809","last_updated":"2026-05-12T23:01:29Z","snapshot_observed_at":"2026-07-06T23:24:27.821980Z","submitted_at":"2026-05-12T23:01:29Z","title":"Correcting Influence: Unboxing LLM Outputs with Orthogonal Latent Spaces","version":1},"reference_index":273,"source":"arxiv_source","source_observed_at":"2026-05-14T20:17:01.224864Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2605.12809"},"observation_digest":"sha256:7691ea770b270fb5685d6442fa1bcf1f5afd9a5e3fd065ae3b8416471625944d","observation_id":"6c7c9610-8721-45e3-9d8c-3007f8521b22","resolution":{"observed_at":"2026-05-14T20:17:54.489596Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":"2311.00871","doi":"10.48550/arxiv.2311.00871","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023 , month = nov, journal =","venue":"arXiv (Cornell University)","work_id":"f96fb77a-b470-470f-b661-3b86902dcffe","year":2023},"citing_paper":{"arxiv_id":"2606.02211","last_updated":"2026-06-01T13:10:49Z","snapshot_observed_at":"2026-08-02T18:41:16.377453Z","submitted_at":"2026-06-01T13:10:49Z","title":"Consistency Training while Mitigating Obfuscation via Rate Matching","version":1},"reference_index":117,"source":"arxiv_source","source_observed_at":"2026-06-28T14:25:43.147442Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2606.02211"},"observation_digest":"sha256:31cc81e2312483176ab2649ec6ebb80c1d4e0894600afe837c69d2c36571199b","observation_id":"5a2e7b37-9a8a-4db3-a3ae-77e582594de5","resolution":{"observed_at":"2026-06-28T14:32:18.135024Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":"2311.00871","doi":"10.48550/arxiv.2311.00871","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023 , month = nov, journal =","venue":"arXiv (Cornell University)","work_id":"f96fb77a-b470-470f-b661-3b86902dcffe","year":2023},"citing_paper":{"arxiv_id":"2606.06814","last_updated":"2026-06-05T01:35:42Z","snapshot_observed_at":"2026-08-05T13:20:43.182005Z","submitted_at":"2026-06-05T01:35:42Z","title":"The Effect of Training Task Diversity on In-Context Learning through the Lens of Low-Dimensional Subspaces","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-27T21:04:42.952768Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2606.06814"},"observation_digest":"sha256:670c80650b3edccd9bf85e8ae6da877dfdc6b65bb31e49c354ce59244511ae15","observation_id":"6201558a-4a0c-4fa4-a280-86eac8ca2c96","resolution":{"observed_at":"2026-07-02T20:07:21.141557Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":"2311.00871","doi":"10.48550/arxiv.2311.00871","metadata_source":"arxiv_reference","pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"2023 , month = nov, journal =","venue":"arXiv (Cornell University)","work_id":"f96fb77a-b470-470f-b661-3b86902dcffe","year":2023},"citing_paper":{"arxiv_id":"2606.19476","last_updated":"2026-06-17T18:11:06Z","snapshot_observed_at":"2026-08-01T19:10:48.483631Z","submitted_at":"2026-06-17T18:11:06Z","title":"Can In-Context Learning Support Intrinsic Curiosity?","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-06-26T21:22:02.967893Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2606.19476"},"observation_digest":"sha256:c558b3d080be073696a9bcac4328829729b6ef6885434e58ac4a36b9cbe7549d","observation_id":"4771fc72-d96e-4a8e-a2ee-5002b911582f","resolution":{"observed_at":"2026-07-04T00:19:13.125900Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-07-12T06:58:39.213932Z","title":"Pretraining data mixtures enable narrow model selection capabilities in transformer models.arXiv preprint arXiv:2311.00871,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.02800","last_updated":"2026-07-02T22:19:26Z","snapshot_observed_at":"2026-08-03T10:27:13.573981Z","submitted_at":"2026-07-02T22:19:26Z","title":"Induction Heads Interpolate N-Grams","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-12T06:58:39.213932Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2607.02800"},"observation_digest":"sha256:f81803cc25f051fef24ae4c2c58124b60652e3f6e2ef5b6d62dd733549a18a31","observation_id":"167051eb-a671-4f62-a48c-d609bf3d034e","resolution":{"observed_at":"2026-07-12T06:58:39.213932Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.00871","snapshot_observed_at":"2026-07-30T12:03:28.592234Z","title":"Pretraining","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.23804","last_updated":"2026-07-26T19:06:29Z","snapshot_observed_at":"2026-07-30T23:56:46.291303Z","submitted_at":"2026-07-26T19:06:29Z","title":"How Context Attribution Handles What the Model Already Knows","version":1},"reference_index":168,"source":"arxiv_source","source_observed_at":"2026-07-30T12:03:28.592234Z"},"links":{"cited_paper":"/paper/2311.00871","citing_paper":"/paper/2607.23804"},"observation_digest":"sha256:8412e4f3cbc52a3b5c8460de0fd99334647bb020fdf0e584924e4fe7c56ca594","observation_id":"fe33d829-6f48-4ffb-beb9-adf931e618d8","resolution":{"observed_at":"2026-07-30T12:03:28.592234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2311.00871/citation-record","integrity":"/paper/2311.00871/integrity","json":"/paper/2311.00871/citation-record.json","paper":"/paper/2311.00871"},"outbound":[],"paper":{"arxiv_id":"2311.00871","last_updated":"2023-11-01T21:41:08Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-07-06T16:41:56.099361Z","submitted_at":"2023-11-01T21:41:08Z","title":"Pretraining Data Mixtures Enable Narrow Model Selection Capabilities in Transformer Models"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 14 inbound Pith citation observations for arXiv:2311.00871."}