{"as_of":"2026-08-09T02:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8eaaf529f1a56b0f12ac0fe85e2c808c4c1e1468915fb827c401a02d776df7f9","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":43,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T22:01:38.758074Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"arxiv_reference","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":100,"observed_at":"2026-08-05T02:28:24.338817Z","source":"arxiv_reference"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2305.18565","last_updated":"2023-05-29T18:58:38Z","snapshot_observed_at":"2026-08-07T07:27:51.369423Z","submitted_at":"2023-05-29T18:58:38Z","title":"PaLI-X: On Scaling up a Multilingual Vision and Language Model","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-17T14:36:09.971825Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2305.18565"},"observation_digest":"sha256:50390e73e1a7b83bccc02868990a29a5e174b815b3fb7042936ac57eeb14d82f","observation_id":"4e658e63-1018-415e-924b-3bb66b837360","resolution":{"observed_at":"2026-05-17T14:36:10.077740Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2309.03409","last_updated":"2024-04-15T07:50:32Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-07T00:07:15Z","title":"Large Language Models as Optimizers","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-15T00:04:31.212102Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2309.03409"},"observation_digest":"sha256:5922b917a140bdd7df3afcc28d217611efd0f17002f0688be1fd8a4f20ca78d0","observation_id":"d59144a9-7e16-475d-8557-baed50f2f007","resolution":{"observed_at":"2026-05-15T00:04:31.329036Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2310.14566","last_updated":"2024-03-25T06:05:24Z","snapshot_observed_at":"2026-08-02T21:20:28.501823Z","submitted_at":"2023-10-23T04:49:09Z","title":"HallusionBench: An Advanced Diagnostic Suite for Entangled Language Hallucination and Visual Illusion in Large Vision-Language Models","version":5},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-17T01:22:04.035994Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2310.14566"},"observation_digest":"sha256:bbebd43408e322d61e3859ced5e68e6be3b1d96963c50512b128f5d16e392be7","observation_id":"f1b636a9-9227-42de-bb0b-0d4e65af8b2b","resolution":{"observed_at":"2026-05-17T01:22:04.165365Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2403.07974","last_updated":"2024-06-06T17:41:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-12T17:58:04Z","title":"LiveCodeBench: Holistic and Contamination Free Evaluation of Large Language Models for Code","version":2},"reference_index":199,"source":"arxiv_source","source_observed_at":"2026-05-10T17:34:42.565806Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2403.07974"},"observation_digest":"sha256:c3bd92b1496500f4621d3f64aeb811c60156aa9c72fe8808aa36f86fdcd248c6","observation_id":"a4da1d9f-9bec-48fa-b80a-a73b4b63883d","resolution":{"observed_at":"2026-05-10T17:34:42.816705Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-08T22:01:38.758074Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.05233","last_updated":"2025-02-07T04:24:07Z","snapshot_observed_at":"2026-08-08T21:56:24.429176Z","submitted_at":"2025-02-07T04:24:07Z","title":"Efficient Knowledge Feeding to Language Models: A Novel Integrated Encoder-Decoder Architecture","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T22:01:38.758074Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2502.05233"},"observation_digest":"sha256:06cb015e61ab6a4e20a64bbda0432f2424ab02f59a828540428728c42a42ee87","observation_id":"459ecde1-0762-4349-9e7b-6903b4a72f76","resolution":{"observed_at":"2026-08-08T22:01:38.758074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-08T14:11:54.661994Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.06990","last_updated":"2025-02-10T19:36:21Z","snapshot_observed_at":"2026-08-08T14:05:14.481704Z","submitted_at":"2025-02-10T19:36:21Z","title":"Investigating the Zone of Proximal Development of Language Models for In-Context Learning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-08T14:11:54.661994Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2502.06990"},"observation_digest":"sha256:91a390640408675f0d894ad13bc7ea8e05c76d4c21665a76a5bee01778707a00","observation_id":"25b5a2eb-cc23-468f-b2aa-88f2d0ef7b75","resolution":{"observed_at":"2026-08-08T14:11:54.661994Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-07T15:27:53.820426Z","title":"Larger language models do in-context learning differently","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.15143","last_updated":"2025-05-21T06:00:41Z","snapshot_observed_at":"2026-08-08T06:05:52.295070Z","submitted_at":"2025-05-21T06:00:41Z","title":"Filtering Learning Histories Enhances In-Context Reinforcement Learning","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T15:27:53.820426Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2505.15143"},"observation_digest":"sha256:4d669b2778cd03525db12b3e0a1c55625b7c6aa5341cc477944b1894ea351340","observation_id":"c3264548-9292-4203-bea1-66d81c3bd693","resolution":{"observed_at":"2026-08-07T15:27:53.820426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2506.07298","last_updated":"2026-04-24T00:35:40Z","snapshot_observed_at":"2026-07-31T18:37:39.269136Z","submitted_at":"2025-06-08T21:49:38Z","title":"Pre-trained Large Language Models Learn Hidden Markov Models In-context","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-19T10:34:40.987583Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2506.07298"},"observation_digest":"sha256:665bea75d18113a60e23a780bc1438c6ce02c067e4541df6262fee6a421070b5","observation_id":"f74c2a9e-cb36-4b0b-97a6-86a64319831e","resolution":{"observed_at":"2026-05-19T10:37:15.088251Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-07T05:10:39.580010Z","title":"Larger language models do in-context learning differently","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.08669","last_updated":"2025-06-10T10:30:43Z","snapshot_observed_at":"2026-08-08T04:30:56.447904Z","submitted_at":"2025-06-10T10:30:43Z","title":"Enhancing Reasoning Capabilities of Small Language Models with Blueprints and Prompt Template Search","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-07T05:10:39.580010Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2506.08669"},"observation_digest":"sha256:23ed652d56301896b59d9e3f48aedc3cce066b6884e1b6253cb9fa4c0bc9e2ff","observation_id":"fd5eb637-3f5e-40c1-a072-fe4f88997273","resolution":{"observed_at":"2026-08-07T05:10:39.580010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-06T21:38:15.320523Z","title":"Larger language models do in-context learning differently","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.00092","last_updated":"2025-06-30T09:53:41Z","snapshot_observed_at":"2026-08-08T10:51:41.279421Z","submitted_at":"2025-06-30T09:53:41Z","title":"Thinking About Thinking: SAGE-nano's Inverse Reasoning for Self-Aware Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T21:38:15.320523Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2507.00092"},"observation_digest":"sha256:82efcbcac26b33d5d672ee98928a6a72646f562e47c21215b8f54f2f64df229f","observation_id":"dcd7efd4-f557-428e-9306-70fc13f5d681","resolution":{"observed_at":"2026-08-06T21:38:15.320523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T14:44:28.040635Z","title":"Larger language models do in-context learning differently,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2508.21003","last_updated":"2025-08-28T17:04:43Z","snapshot_observed_at":"2026-08-07T20:33:39.576182Z","submitted_at":"2025-08-28T17:04:43Z","title":"InSQuAD: In-Context Learning for Efficient Retrieval via Submodular Mutual Information to Enforce Quality and Diversity","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-05T14:44:28.040635Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2508.21003"},"observation_digest":"sha256:78ab7c895b22c2ed95a5fbd9ba31ccd66610ae6f4c232d307a15c104a16b7fab","observation_id":"45ec1ead-21cc-418f-afb0-61cf9278ec1a","resolution":{"observed_at":"2026-08-05T14:44:28.040635Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T12:49:12.452422Z","title":"arXiv preprint arXiv:2303.03846 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.01236","last_updated":"2025-09-01T08:24:28Z","snapshot_observed_at":"2026-08-07T20:28:17.716897Z","submitted_at":"2025-09-01T08:24:28Z","title":"Rethinking the Chain-of-Thought: The Roles of In-Context Learning and Pre-trained Priors","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-05T12:49:12.452422Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2509.01236"},"observation_digest":"sha256:aaec25817021b33fa24c1b75df55f3a527b93622493dd07320fc6845af75da61","observation_id":"e47e5f30-49b6-4893-92dd-f6423560770f","resolution":{"observed_at":"2026-08-05T12:49:12.452422Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-04T22:12:12.892191Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.07512","last_updated":"2025-09-09T08:47:13Z","snapshot_observed_at":"2026-08-07T00:48:03.842932Z","submitted_at":"2025-09-09T08:47:13Z","title":"ALLabel: Three-stage Active Learning for LLM-based Entity Recognition using Demonstration Retrieval","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-04T22:12:12.892191Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2509.07512"},"observation_digest":"sha256:8aefac4eafe4a7bc31b64293bfffa6a37c423f02f4373e3c46b1e10476f4e022","observation_id":"788a7275-8aca-4cd5-a3a2-8efcad524532","resolution":{"observed_at":"2026-08-04T22:12:12.892191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-04T20:04:29.447841Z","title":"Larger language models do in-context learning differently,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.08910","last_updated":"2025-09-10T18:14:52Z","snapshot_observed_at":"2026-08-07T14:21:33.639618Z","submitted_at":"2025-09-10T18:14:52Z","title":"PromptGuard: An Orchestrated Prompting Framework for Principled Synthetic Text Generation for Vulnerable Populations using LLMs with Enhanced Safety, Fairness, and Controllability","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-04T20:04:29.447841Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2509.08910"},"observation_digest":"sha256:d1ee617d0dccb6f03b52d5480d5d65da91bb4b339c719b9ce803b5fb28f919dd","observation_id":"e43ecbfb-f179-439d-802f-be5b4065a4af","resolution":{"observed_at":"2026-08-04T20:04:29.447841Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2509.11295","last_updated":"2026-04-29T13:18:01Z","snapshot_observed_at":"2026-07-06T22:29:58.066459Z","submitted_at":"2025-09-14T14:39:35Z","title":"The Prompt Engineering Report Distilled: Quick Start Guide for Life Sciences","version":2},"reference_index":133,"source":"pdf_text","source_observed_at":"2026-05-18T16:39:03.794436Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2509.11295"},"observation_digest":"sha256:f66e90862a3ffd91a6005bf26e60359c3ec094f8f6ec4268ec22a2785f68f033","observation_id":"83782554-1bfc-47e5-95b3-bd1140f90b06","resolution":{"observed_at":"2026-05-18T16:41:38.086834Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2509.11295","last_updated":"2026-04-29T13:18:01Z","snapshot_observed_at":"2026-07-06T22:29:58.066459Z","submitted_at":"2025-09-14T14:39:35Z","title":"The Prompt Engineering Report Distilled: Quick Start Guide for Life Sciences","version":2},"reference_index":134,"source":"pdf_text","source_observed_at":"2026-05-18T16:39:03.794436Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2509.11295"},"observation_digest":"sha256:26a96046ee30b975c61fc8d87a2c228abee17d30a4993a34f0e4736ad9c15c10","observation_id":"e3e2f62a-3369-4b5e-baa9-1e6a0ddb76bd","resolution":{"observed_at":"2026-05-18T16:41:37.436256Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-04T16:31:55.644920Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.13196","last_updated":"2026-07-26T20:47:50Z","snapshot_observed_at":"2026-08-08T05:40:25.942371Z","submitted_at":"2025-09-16T16:00:06Z","title":"The Few-shot Dilemma: Over-prompting Large Language Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-04T16:31:55.644920Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2509.13196"},"observation_digest":"sha256:439060d564c5896728479d0134f0bbdfd901ef1f590b2f5296a96bea37ed0718","observation_id":"2306f87c-f3eb-49df-a765-46af29a78816","resolution":{"observed_at":"2026-08-04T16:31:55.644920Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2509.24164","last_updated":"2026-04-30T20:04:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-29T01:28:37Z","title":"Localizing Task Recognition and Task Learning in In-Context Learning via Attention Head Analysis","version":3},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-18T13:26:59.080330Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2509.24164"},"observation_digest":"sha256:681ab3394f4844be60a4520b40e144bbaf746a90262907b5e9ceab5f1e2b05f2","observation_id":"be039bba-4d1f-4288-92d1-1e4ecad38c07","resolution":{"observed_at":"2026-05-18T13:31:25.449430Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-03T20:37:41.746594Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.19166","last_updated":"2026-07-21T15:21:25Z","snapshot_observed_at":"2026-08-03T20:37:36.623362Z","submitted_at":"2025-11-24T14:28:50Z","title":"Epistemic Familiarity is Associated With Belief Stability in Large Language Models","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T20:37:41.746594Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2511.19166"},"observation_digest":"sha256:7f1d0feca3d737b3b65b3225a8e8143cf9afdaea663745ef068a12d6c270ce11","observation_id":"fc8d0f1a-55da-4d14-9eda-3ac28cafdab1","resolution":{"observed_at":"2026-08-03T20:37:41.746594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-03T07:50:48.721927Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2601.19072","last_updated":"2026-06-11T01:26:21Z","snapshot_observed_at":"2026-08-03T07:50:43.889442Z","submitted_at":"2026-01-27T01:16:45Z","title":"HalluJudge: A Reference-Free Hallucination Detection for Context Misalignment in Code Review Automation","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T07:50:48.721927Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2601.19072"},"observation_digest":"sha256:e1c3c96e17e0a1c3b8745ff8e57b2c05b2a064c855567f1d31da60c50b35a2e3","observation_id":"02b06cfc-026c-4b06-9e01-fcc448f74276","resolution":{"observed_at":"2026-08-03T07:50:48.721927Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-03T07:15:11.061072Z","title":"Larger language models do in-context learning differently.arXiv preprint arXiv:2303.03846,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2601.20796","last_updated":"2026-05-26T14:33:44Z","snapshot_observed_at":"2026-08-03T07:15:07.656197Z","submitted_at":"2026-01-28T17:37:28Z","title":"Dissecting Multimodal In-Context Learning: Modality Asymmetries and Circuit Dynamics in modern Transformers","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T07:15:11.061072Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2601.20796"},"observation_digest":"sha256:ba0825ba65d394a4b5f73ee18f977471f91ac338d104b9071fb03a42e83cf15f","observation_id":"561b3272-4cbd-4b76-ad09-b5ff27581c58","resolution":{"observed_at":"2026-08-03T07:15:11.061072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-02T21:53:26.043170Z","title":"Larger language models do in-context learning differently.arXiv preprint arXiv:2303.03846,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.18905","last_updated":"2026-06-05T06:00:51Z","snapshot_observed_at":"2026-08-08T15:43:47.482851Z","submitted_at":"2026-02-21T17:00:54Z","title":"TRUE: A Trustworthy Unified Explanation Framework for Large Language Model Reasoning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T21:53:26.043170Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2602.18905"},"observation_digest":"sha256:5f75219df918efa6308734388dea87c5ce1df929a20dc173100ecae22128285b","observation_id":"f6dc2c33-d46c-4013-a9cf-62ff463f5d47","resolution":{"observed_at":"2026-08-02T21:53:26.043170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2604.13275","last_updated":"2026-04-14T20:12:05Z","snapshot_observed_at":"2026-07-06T23:01:19.191464Z","submitted_at":"2026-04-14T20:12:05Z","title":"Better and Worse with Scale: How Contextual Entrainment Diverges with Model Size","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T15:18:33.458143Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2604.13275"},"observation_digest":"sha256:02551ac695a701f4c5743ad6aac8ad22d356274f9affe5352bba026a65817300","observation_id":"b59e0244-9a21-4165-b372-e7231690caf9","resolution":{"observed_at":"2026-05-11T10:46:06.578259Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2604.15789","last_updated":"2026-04-17T07:50:42Z","snapshot_observed_at":"2026-07-06T23:03:16.345488Z","submitted_at":"2026-04-17T07:50:42Z","title":"A Systematic Study of Training-Free Methods for Trustworthy Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-10T08:19:42.671690Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2604.15789"},"observation_digest":"sha256:953f336b0bce7ea18cc3e3af7fbd55e056848f98685f99615fa4f273e9a1d133","observation_id":"b7cae361-3a85-4923-bbef-25b2a0f3e20c","resolution":{"observed_at":"2026-05-10T08:22:37.347716Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2604.23267","last_updated":"2026-05-18T09:56:09Z","snapshot_observed_at":"2026-07-06T23:09:29.537323Z","submitted_at":"2026-04-25T12:19:25Z","title":"Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-08T08:06:25.436395Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2604.23267"},"observation_digest":"sha256:4b331a8bac0d8bdf3df4307eda458ccb07fbf1fa52860096e6475d1384f37bc1","observation_id":"8ba62ed8-9207-401e-96d3-72bc2b2d395d","resolution":{"observed_at":"2026-05-11T20:46:12.429451Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2604.23267","last_updated":"2026-05-18T09:56:09Z","snapshot_observed_at":"2026-07-06T23:09:29.537323Z","submitted_at":"2026-04-25T12:19:25Z","title":"Fine-tuning vs. In-context Learning in Large Language Models: A Formal Language Learning Perspective","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-05-21T00:33:22.181383Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2604.23267"},"observation_digest":"sha256:31ccba1193be09f1fd34d7017a1d057f48294394f02d49bcdbfd5c16945fbe5f","observation_id":"dcf14d39-eb40-4b58-b690-f16809c65352","resolution":{"observed_at":"2026-05-21T00:33:52.610086Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2605.03780","last_updated":"2026-05-05T14:07:55Z","snapshot_observed_at":"2026-08-02T05:55:01.910212Z","submitted_at":"2026-05-05T14:07:55Z","title":"Task Vector Geometry Underlies Dual Modes of Task Inference in Transformers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-07T16:37:26.420806Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2605.03780"},"observation_digest":"sha256:58a6d7a7317eb898c45166fc4e04b671e36371494711826e0b3b7862cdfb236a","observation_id":"2bc6d862-5e85-4348-a4ce-8ae15f615a1c","resolution":{"observed_at":"2026-05-11T23:36:36.356040Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2605.08295","last_updated":"2026-05-08T10:20:39Z","snapshot_observed_at":"2026-07-06T23:20:33.816373Z","submitted_at":"2026-05-08T10:20:39Z","title":"In-Context Fixation: When Demonstrated Labels Override Semantics in Few-Shot Classification","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-12T01:43:23.458204Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2605.08295"},"observation_digest":"sha256:33303206d633f54f99a266817cffc411f7e38eefec56e6d914604420511b9203","observation_id":"00c0c115-2ac4-4391-84ce-2f47e227e51c","resolution":{"observed_at":"2026-05-12T01:46:14.055573Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2605.08904","last_updated":"2026-05-09T11:51:34Z","snapshot_observed_at":"2026-07-06T23:21:02.177557Z","submitted_at":"2026-05-09T11:51:34Z","title":"OPT-BENCH: Evaluating the Iterative Self-Optimization of LLM Agents in Large-Scale Search Spaces","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-12T02:57:15.521594Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2605.08904"},"observation_digest":"sha256:fef5bd1b1d7f4de02c824325a7698d36c04aa0499e9ea2bb52c3de5d1ef462c3","observation_id":"0fa17252-65e4-4138-a451-8bd5750c2291","resolution":{"observed_at":"2026-05-12T03:01:18.782497Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2605.18830","last_updated":"2026-05-12T21:43:48Z","snapshot_observed_at":"2026-07-06T23:29:38.069295Z","submitted_at":"2026-05-12T21:43:48Z","title":"In-Context Learning Operates as Concept Subspace Learning","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T21:34:43.735483Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2605.18830"},"observation_digest":"sha256:c2196db2c908a3dd3495d8564b3b5274ef698635ae7aa26ddc8751c89592874d","observation_id":"80bd20c5-129e-4a35-a636-ddc87546fbfd","resolution":{"observed_at":"2026-05-20T21:39:03.530910Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2605.21974","last_updated":"2026-05-21T04:08:42Z","snapshot_observed_at":"2026-07-06T23:32:20.708664Z","submitted_at":"2026-05-21T04:08:42Z","title":"Format-Constraint Coupling in Knowledge Graph Construction from Statistical Tables","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-22T06:43:31.886617Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2605.21974"},"observation_digest":"sha256:f98d2eb9abc0c35893907517521ffdcab2bd4d03ceb9482121689e53f118d1f0","observation_id":"af732792-de14-487a-ae3d-4917197ce288","resolution":{"observed_at":"2026-05-22T06:44:41.994609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2605.26350","last_updated":"2026-05-25T21:52:49Z","snapshot_observed_at":"2026-07-06T23:36:11.031436Z","submitted_at":"2026-05-25T21:52:49Z","title":"When Correct Demonstrations Hurt: Rethinking the Role of Exemplars in In-Context Learning","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-29T22:23:59.570806Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2605.26350"},"observation_digest":"sha256:89904ffa45cbd715342f16ec93304a7fe70bd546ec976b32e9761721c842a04a","observation_id":"8aab40c2-6bfe-4824-a75a-4707d30d37e0","resolution":{"observed_at":"2026-06-29T22:34:02.708392Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2605.29548","last_updated":"2026-06-01T17:29:35Z","snapshot_observed_at":"2026-08-02T17:41:19.598860Z","submitted_at":"2026-05-28T08:02:11Z","title":"Why Larger Models Learn More: Effects of Capacity, Interference, and Rare-Task Retention","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-29T08:39:14.327838Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2605.29548"},"observation_digest":"sha256:a44bf553a12ae0f11bdb8c2c9b75bdd337479fe774cb9801c11a94ab751f0c49","observation_id":"42d1e624-0c23-44f1-96eb-58d83776ca43","resolution":{"observed_at":"2026-06-29T08:43:15.245291Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2606.02953","last_updated":"2026-06-01T23:11:39Z","snapshot_observed_at":"2026-08-07T02:14:32.865026Z","submitted_at":"2026-06-01T23:11:39Z","title":"Linguistic Productivity in Large Language Models: Models Coerce, but do not Preempt","version":1},"reference_index":263,"source":"arxiv_source","source_observed_at":"2026-06-28T14:13:13.648560Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2606.02953"},"observation_digest":"sha256:6e928ac37d22a2e49d78f65d82592dc88a9e5a0edb725931d6ab7189ed5a0b87","observation_id":"ed8833ba-17ac-4022-bdd8-504c5be1d68f","resolution":{"observed_at":"2026-07-01T23:36:22.769987Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2606.03089","last_updated":"2026-06-16T07:22:07Z","snapshot_observed_at":"2026-07-06T23:43:22.513369Z","submitted_at":"2026-06-02T03:17:56Z","title":"Constitutional On-Policy Safe Distillation","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T11:47:14.135793Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2606.03089"},"observation_digest":"sha256:8ca95a152a40f825e7a881bec49f2a9c47f8865ac332e880cd63d4b7fd1c9c79","observation_id":"b5373456-2d4f-4be2-90e6-8d3082361eab","resolution":{"observed_at":"2026-07-02T01:36:25.452154Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2606.04320","last_updated":"2026-06-03T00:48:44Z","snapshot_observed_at":"2026-07-06T23:44:28.265478Z","submitted_at":"2026-06-03T00:48:44Z","title":"OpenRFM: Dissecting Relational In-Context Learning","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-28T07:37:38.063200Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2606.04320"},"observation_digest":"sha256:9aff15f2820a5d6520daf0a4464bfc5824f531755ec1389181ed5e977d6b24f9","observation_id":"e4c85886-a6f7-449e-8f29-18b2ced1375a","resolution":{"observed_at":"2026-07-02T06:06:41.434356Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2606.07555","last_updated":"2026-08-01T07:33:34Z","snapshot_observed_at":"2026-08-06T23:11:19.871383Z","submitted_at":"2026-05-25T05:53:31Z","title":"Priors Persist Through Suppression: A Stroop Paradigm for Lexical Override","version":3},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-29T22:15:37.716848Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2606.07555"},"observation_digest":"sha256:3f3c5ca26d3b0aadf1c9b715ec84b99b52b85827c97d7371c01349fd2074ab47","observation_id":"861b3f0f-7ebc-4ff1-a11d-f3c4767e34dc","resolution":{"observed_at":"2026-06-29T22:24:00.809430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2606.08068","last_updated":"2026-07-08T15:21:39Z","snapshot_observed_at":"2026-07-12T14:47:31.355938Z","submitted_at":"2026-06-06T09:33:32Z","title":"DICE: Entropy-Regularized Equilibrium Selection for Stable Multi-Agent LLM Coordination","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-06-27T19:58:32.016341Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2606.08068"},"observation_digest":"sha256:588594ee762df40167c93b0e4c60d64774f8104b96c979ae9b8a9f27c2cc44ab","observation_id":"1c8d6e12-362a-441c-974c-c3133892e7a2","resolution":{"observed_at":"2026-07-02T21:07:23.533197Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":"2303.03846","doi":"10.48550/arxiv.2303.03846","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"arXiv preprint arXiv:2303.03846 , year =","venue":"arXiv (Cornell University)","work_id":"583ca0e5-c312-49d2-a128-f829fccd49e1","year":2023},"citing_paper":{"arxiv_id":"2606.13001","last_updated":"2026-06-11T07:38:15Z","snapshot_observed_at":"2026-07-06T23:51:49.819867Z","submitted_at":"2026-06-11T07:38:15Z","title":"CFALR: Collaborative Filtering-Augmented Large Language Model for Personalized Fashion Outfit Recommendation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-27T05:56:51.623324Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2606.13001"},"observation_digest":"sha256:058c78cfa3a17ef5e57a5e596ca810e1565bdb9d016577411f9429d8e6dc8c9c","observation_id":"3fd48ac8-6c08-4481-873e-7b6fc42cd60b","resolution":{"observed_at":"2026-07-03T16:18:37.608265Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-07-12T00:51:41.905788Z","title":"Jingfeng Wu, Difan Zou, Zixiang Chen, Vladimir Braverman, Quanquan Gu, and Peter Bartlett","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.03660","last_updated":"2026-07-04T01:47:29Z","snapshot_observed_at":"2026-08-07T05:34:25.091820Z","submitted_at":"2026-07-04T01:47:29Z","title":"Sequential Correlations Change In-Context Learning: Effective Context Length and Architectural Mismatch","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-12T00:51:41.905788Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2607.03660"},"observation_digest":"sha256:7528f4e50e5d387d58452717441987e43136d225455edc9a560fef7820d15322","observation_id":"d5cbf27c-8551-4941-b86f-e792888a46c0","resolution":{"observed_at":"2026-07-12T00:51:41.905788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-07-11T10:18:01.537693Z","title":"arXiv preprint arXiv:2303.03846 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.05001","last_updated":"2026-07-07T04:36:22Z","snapshot_observed_at":"2026-08-04T05:06:36.769842Z","submitted_at":"2026-07-06T12:41:11Z","title":"TACTIC-KG: Toward Small Agent Teams for Cyber Threat Intelligence Knowledge Graph Construction","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-11T10:18:01.537693Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2607.05001"},"observation_digest":"sha256:8e3b3aa73219188247a7f00a81732b1599e484a38b831d2bbda7efc2706af99e","observation_id":"fe66e50a-6844-4116-a491-60e63c3f7903","resolution":{"observed_at":"2026-07-11T10:18:01.537693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-02T05:16:38.005390Z","title":"Larger language models do in-context learning differently.arXiv preprint arXiv:2303.03846,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13425","last_updated":"2026-07-15T04:03:24Z","snapshot_observed_at":"2026-08-03T17:12:53.669172Z","submitted_at":"2026-07-15T04:03:24Z","title":"Data-Efficient Adaptation of LLMs via Attention Head Reweighting","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-02T05:16:38.005390Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2607.13425"},"observation_digest":"sha256:b5137e6c77b67ff7226922e20f62fe508d55831846d7636229e640cf36072978","observation_id":"e28cdf2d-ce2c-4581-9cb4-0770747ede57","resolution":{"observed_at":"2026-08-02T05:16:38.005390Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03846","snapshot_observed_at":"2026-08-01T07:28:33.761223Z","title":"arXiv preprint arXiv:2303.03846 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.21453","last_updated":"2026-07-24T02:14:44Z","snapshot_observed_at":"2026-08-03T14:01:50.133228Z","submitted_at":"2026-07-23T15:55:29Z","title":"Test-Time Scaling via Error Localization","version":2},"reference_index":151,"source":"arxiv_source","source_observed_at":"2026-08-01T07:28:33.761223Z"},"links":{"cited_paper":"/paper/2303.03846","citing_paper":"/paper/2607.21453"},"observation_digest":"sha256:b75fdbbda98ea3002966eff2d3b2c39584d94192165faf5866034683d9fc36ab","observation_id":"7a1dfc39-61a7-4f8a-a4d0-070c80358a84","resolution":{"observed_at":"2026-08-01T07:28:33.761223Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2303.03846/citation-record","integrity":"/paper/2303.03846/integrity","json":"/paper/2303.03846/citation-record.json","paper":"/paper/2303.03846"},"outbound":[],"paper":{"arxiv_id":"2303.03846","last_updated":"2023-03-08T07:37:43Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T14:59:39.238136Z","submitted_at":"2023-03-07T12:24:17Z","title":"Larger language models do in-context learning differently"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 43 inbound Pith citation observations for arXiv:2303.03846."}