{"as_of":"2026-08-07T06:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:2f297f877cdc74d5f661b47817580b7659a53a30fb967ef89a7a6acd7b7f60a5","coverage":[{"denominator":43,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":43,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T15:20:38.759814Z","state":"measured"},{"denominator":43,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":43,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.16217/citation-record","integrity":"/paper/2507.16217/integrity","json":"/paper/2507.16217/citation-record.json","paper":"/paper/2507.16217"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2404.11018","last_updated":"2024-10-17T17:45:09Z","snapshot_observed_at":"2026-07-06T18:01:18.745347Z","submitted_at":"2024-04-17T02:49:26Z","title":"Many-Shot In-Context Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.11018","snapshot_observed_at":"2026-08-06T15:20:37.947720Z","title":"Many-shot in-context learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:37.947720Z"},"links":{"cited_paper":"/paper/2404.11018","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:1bb0f2ed93edf02888dcf1c7288a9fd3eea3e64d2525aff66056570310f5d171","observation_id":"e5e89fd3-20cc-4642-b088-769d17eb2978","resolution":{"observed_at":"2026-08-06T15:20:37.947720Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-06T15:20:38.117131Z","title":"Rohan Anil, Sebastian Borgeaud, Jean-Baptiste Alayrac, Jiahui Yu, Radu Soricut, Johan Schalkwyk, Andrew M Dai, Anja Hauth, Katie Millican, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.117131Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:867fe526ae26be4951b3b9ab65ccd9e6cfe7af4efa30b70902a4b08f2da38327","observation_id":"4260c449-f816-497e-ab0f-7f3958d2a966","resolution":{"observed_at":"2026-08-06T15:20:38.117131Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.00200","last_updated":"2025-03-03T19:53:28Z","snapshot_observed_at":"2026-08-04T16:59:22.807968Z","submitted_at":"2024-04-30T21:06:52Z","title":"In-Context Learning with Long-Context Models: An In-Depth Exploration","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.00200","snapshot_observed_at":"2026-08-06T15:20:38.350555Z","title":"In-context learning with long-context models: An in-depth exploration","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.350555Z"},"links":{"cited_paper":"/paper/2405.00200","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:57288dc8f4f457f4a93668d66194db65fef756a584d2470c59f730041831b07a","observation_id":"7bbeede1-aceb-4780-bf81-11f250e6d22c","resolution":{"observed_at":"2026-08-06T15:20:38.350555Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.400143Z","title":"impact of sample selection on in-context learning for entity extraction from scientific writing","venue":null,"work_id":"4d807e08-79d1-4d96-bfde-c277ff67ca1e","year":2023},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.475720Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:ffe4101ca331475e5f80d2735e6e1ed2796aea16643ebd58c9bd19bf28b8a5be","observation_id":"91197974-bb70-419e-a4fa-fbb1f1e7438a","resolution":{"observed_at":"2026-08-06T15:20:39.405156Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.findings-emnlp.338","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:38.804220Z","title":"doi: 10.18653/v1/2023.findings-emnlp.338","venue":null,"work_id":"b4d1263a-35d7-4097-84aa-ece4a8406087","year":2023},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.506227Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:f6f1bf9f744fe9fc3f2bbad949c1d10613f8d74eae504b836e28eed8bbadea47","observation_id":"29bf1371-ae60-49f6-bca4-c790bdedfca5","resolution":{"observed_at":"2026-08-06T15:20:38.809679Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.383493Z","title":"Papailiopoulos, and Kangwook Lee","venue":null,"work_id":"b06e0312-d468-402e-85ff-18cc46213c44","year":2022},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.590206Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:8ab1947d5fda3906baf613d5b54e7b79b38f6f8ce1bf88eb01d7f448314600b5","observation_id":"e91cdd25-7fa1-4323-949b-6a977d22db21","resolution":{"observed_at":"2026-08-06T15:20:39.388329Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.10171","last_updated":"2024-02-15T18:19:16Z","snapshot_observed_at":"2026-08-03T09:02:39.861878Z","submitted_at":"2024-02-15T18:19:16Z","title":"Data Engineering for Scaling Language Models to 128K Context","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.10171","snapshot_observed_at":"2026-08-06T15:20:38.626324Z","title":"Data engineering for scaling language models to 128k context","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.626324Z"},"links":{"cited_paper":"/paper/2402.10171","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:30f738c4c50ac77f680ef24b5879148339b0dab48bed88abaf0d809c2e115548","observation_id":"6089dcf4-55b7-4407-a7b9-99669a33a215","resolution":{"observed_at":"2026-08-06T15:20:38.626324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-06T15:20:38.631968Z","title":"Gemini 1.5: Unlocking multimodal understand- ing across millions of tokens of context","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.631968Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:abfcc3fe41e73dd510543d25a22581733df9207eea6d95a53c9010dec4db2296","observation_id":"29e7bc85-96b5-4e8d-98f4-d4321f4b82bc","resolution":{"observed_at":"2026-08-06T15:20:38.631968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.368407Z","title":"Time travel in llms: Tracing data contamina- tion in large language models","venue":null,"work_id":"2d4cd945-2cfb-4d91-866b-8cdd180c9cab","year":2024},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.636179Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:e5901dec9e97fb5ed2ac9892ca8fd1c5bde4d2fea605013105ed2febb9bdfd52","observation_id":"4944664d-a834-4a4f-8659-fc32c73a031a","resolution":{"observed_at":"2026-08-06T15:20:39.373412Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11546","last_updated":"2025-04-04T02:50:14Z","snapshot_observed_at":"2026-07-06T19:04:00.888268Z","submitted_at":"2024-08-21T11:54:22Z","title":"Memorization in In-Context Learning","version":3},"cited_work":{"arxiv_id":"2408.11546","doi":null,"metadata_source":"pith","pith_arxiv_id":"2408.11546","snapshot_observed_at":"2026-08-06T15:20:39.096329Z","title":"Memorization in In-Context Learning","venue":"cs.CL","work_id":"89cf4720-d403-4744-b680-6dca5be482c4","year":2024},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.640618Z"},"links":{"cited_paper":"/paper/2408.11546","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:a7d7b804ac61218588ec04af0872848c9cc51a0da3f414a695b3ac0a76c0ea9a","observation_id":"e803960a-142f-48d5-b84e-bf3718edcfcd","resolution":{"observed_at":"2026-08-06T15:20:39.100399Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.06713","last_updated":"2022-12-13T16:31:21Z","snapshot_observed_at":"2026-07-06T14:30:08.686540Z","submitted_at":"2022-12-13T16:31:21Z","title":"Structured Prompting: Scaling In-Context Learning to 1,000 Examples","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.06713","snapshot_observed_at":"2026-08-06T15:20:38.648781Z","title":"Accessed: 2025-03-28","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.648781Z"},"links":{"cited_paper":"/paper/2212.06713","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:ade2277ea9d6276c2ddba922144a8b092add011fcb1c751be6340d14aebdf84e","observation_id":"9611d3c9-7e26-4b39-9233-d0419d37f5eb","resolution":{"observed_at":"2026-08-06T15:20:38.648781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.15916","last_updated":"2023-10-24T15:17:14Z","snapshot_observed_at":"2026-08-07T03:42:41.198792Z","submitted_at":"2023-10-24T15:17:14Z","title":"In-Context Learning Creates Task Vectors","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.15916","snapshot_observed_at":"2026-08-06T15:20:38.652663Z","title":"In-context learning creates task vectors","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.652663Z"},"links":{"cited_paper":"/paper/2310.15916","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:06baf32e114d6ed5315d058f9d52201c9b301e69edee5db4f1f074d091d60093","observation_id":"9cb024c4-16b0-4950-b111-3ee26af8895f","resolution":{"observed_at":"2026-08-06T15:20:38.652663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09798","last_updated":"2024-10-04T21:51:47Z","snapshot_observed_at":"2026-07-06T18:15:03.339204Z","submitted_at":"2024-05-16T04:02:43Z","title":"Many-Shot In-Context Learning in Multimodal Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09798","snapshot_observed_at":"2026-08-06T15:20:38.661092Z","title":"Many-shot in-context learning in multimodal foundation models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.661092Z"},"links":{"cited_paper":"/paper/2405.09798","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:31cf725a0f5aecba5db42e6388e7dc69b1f6efc7eec6c9a73d03d7eab38ad4da","observation_id":"95eb9f2f-dd60-4303-995a-fb97ec87b6d8","resolution":{"observed_at":"2026-08-06T15:20:38.661092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.12375","last_updated":"2024-03-13T15:00:20Z","snapshot_observed_at":"2026-08-05T01:14:56.994627Z","submitted_at":"2023-07-23T16:54:41Z","title":"In-Context Learning Learns Label Relationships but Is Not Conventional Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.12375","snapshot_observed_at":"2026-08-06T15:20:38.665510Z","title":"In-context learning in large language models learns label relationships but is not conventional learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.665510Z"},"links":{"cited_paper":"/paper/2307.12375","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:1f37eb71579f274d28c69cf864b9bc90b52cabf80980e58bb23fc2bde7b00e08","observation_id":"6f8215d5-9b8f-48d8-ac21-8d5d05745e2b","resolution":{"observed_at":"2026-08-06T15:20:38.665510Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.20327","last_updated":"2024-03-29T17:56:40Z","snapshot_observed_at":"2026-07-06T17:53:11.000124Z","submitted_at":"2024-03-29T17:56:40Z","title":"Gecko: Versatile Text Embeddings Distilled from Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.20327","snapshot_observed_at":"2026-08-06T15:20:38.669434Z","title":"Gecko: Versatile text embeddings distilled from large language models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.669434Z"},"links":{"cited_paper":"/paper/2403.20327","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:4b4e6a38af512d6d88a32fd96cca5ca939b6131cc1d4c3c61e281aab08c1569c","observation_id":"2019cac0-bec2-4ea6-bd9d-013e0c9b7373","resolution":{"observed_at":"2026-08-06T15:20:38.669434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05579","last_updated":"2024-12-10T05:49:12Z","snapshot_observed_at":"2026-07-31T01:42:39.468673Z","submitted_at":"2024-12-07T08:07:24Z","title":"LLMs-as-Judges: A Comprehensive Survey on LLM-based Evaluation Methods","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05579","snapshot_observed_at":"2026-08-06T15:20:38.673094Z","title":"Llms-as-judges: A comprehensive survey on llm-based evaluation methods","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.673094Z"},"links":{"cited_paper":"/paper/2412.05579","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:59320c2ad2303bf467a300fcc719f038f3520058dd8dc6a11b532b230882fda4","observation_id":"2b114263-aba0-4e37-ab0b-864fca969c3f","resolution":{"observed_at":"2026-08-06T15:20:38.673094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.06804","last_updated":"2021-01-17T23:38:40Z","snapshot_observed_at":"2026-08-02T23:15:54.644289Z","submitted_at":"2021-01-17T23:38:40Z","title":"What Makes Good In-Context Examples for GPT-$3$?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.06804","snapshot_observed_at":"2026-08-06T15:20:38.681218Z","title":"What makes good in-context examples for gpt-3? arXiv preprint arXiv:2101.06804,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.681218Z"},"links":{"cited_paper":"/paper/2101.06804","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:f2fb63304e2b57822c949a6c3a023e6f781c2572d1997b6427bd1f943bd28ec2","observation_id":"a39f48aa-7098-48ac-b5e3-ade49e8e8822","resolution":{"observed_at":"2026-08-06T15:20:38.681218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2202.12837","last_updated":"2022-10-20T14:04:10Z","snapshot_observed_at":"2026-08-01T15:23:39.998892Z","submitted_at":"2022-02-25T17:25:19Z","title":"Rethinking the Role of Demonstrations: What Makes In-Context Learning Work?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.12837","snapshot_observed_at":"2026-08-06T15:20:38.689665Z","title":"Rethinking the role of demonstrations: What makes in-context learning work? arXiv preprint arXiv:2202.12837,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.689665Z"},"links":{"cited_paper":"/paper/2202.12837","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:c14c864b8b525b20831c57024d670d2dd0fe3ffe0e779692dfa7825292bb48c7","observation_id":"586da89a-99a3-4d85-8d54-97db4c097fdb","resolution":{"observed_at":"2026-08-06T15:20:38.689665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.19089","last_updated":"2024-07-26T21:10:50Z","snapshot_observed_at":"2026-07-06T18:52:39.094572Z","submitted_at":"2024-07-26T21:10:50Z","title":"Many-Shot In-Context Learning for Molecular Inverse Design","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.19089","snapshot_observed_at":"2026-08-06T15:20:38.694814Z","title":"Many-shot in-context learning for molecular inverse design","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.694814Z"},"links":{"cited_paper":"/paper/2407.19089","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:b68e6650b38e66d16e092d026943fe931c427fe2a9a89d2d49235e734ccf68d9","observation_id":"2fca83ba-a507-464d-9217-3e2b7e203370","resolution":{"observed_at":"2026-08-06T15:20:38.694814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.14599","last_updated":"2020-05-06T17:01:56Z","snapshot_observed_at":"2026-08-06T16:34:26.983423Z","submitted_at":"2019-10-31T16:50:43Z","title":"Adversarial NLI: A New Benchmark for Natural Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.14599","snapshot_observed_at":"2026-08-06T15:20:38.699188Z","title":"Adversarial nli: A new benchmark for natural language understanding","venue":null,"work_id":null,"year":1910},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.699188Z"},"links":{"cited_paper":"/paper/1910.14599","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:50169b608866bebdf5b708550c0fc9f86d9603caa4fd21e666baec17cb230564","observation_id":"0d26c430-9e59-42db-a2c5-8ede77ffc4e5","resolution":{"observed_at":"2026-08-06T15:20:38.699188Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.335993Z","title":"Can many-shot in-context learning help llms as evaluators? A preliminary empirical study","venue":null,"work_id":"7f96ebdd-3b27-4ec8-87dd-c18e52d29530","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.703550Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:3d5856e42851e87663c2b3891cc655d5c6927b447ce59bd6351566f42da3f90f","observation_id":"ee487ebb-ba47-43cb-bd0a-477afc8b3e92","resolution":{"observed_at":"2026-08-06T15:20:39.341820Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09261","last_updated":"2022-10-17T17:08:26Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-10-17T17:08:26Z","title":"Challenging BIG-Bench Tasks and Whether Chain-of-Thought Can Solve Them","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09261","snapshot_observed_at":"2026-08-06T15:20:38.707607Z","title":"Mirac Suzgun, Nathan Scales, Nathanael Sch¨arli, Sebastian Gehrmann, Yi Tay, Hyung Won Chung, Aakanksha Chowdhery, Quoc V Le, Ed H Chi, Denny Zhou, et al","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.707607Z"},"links":{"cited_paper":"/paper/2210.09261","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:60507dc18a3d8145622396bd3849bd836de4d42dc5ecfad68468a9144aff337b","observation_id":"ae2eafa4-3769-4ce6-9239-dd9d038479b5","resolution":{"observed_at":"2026-08-06T15:20:38.707607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.320884Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":"89e3c0da-0147-45e8-be96-5cac8dd312f3","year":2017},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.715455Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:fc259c82507562ffca552071d319d98fa424d58caa31e09ba39eed6f31aa3ff0","observation_id":"68826746-899d-487a-be83-c61eca0d80c2","resolution":{"observed_at":"2026-08-06T15:20:39.325912Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.15708","last_updated":"2024-11-06T22:07:17Z","snapshot_observed_at":"2026-08-02T05:05:05.468187Z","submitted_at":"2024-06-22T02:07:10Z","title":"Teach Better or Show Smarter? On Instructions and Exemplars in Automatic Prompt Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.15708","snapshot_observed_at":"2026-08-06T15:20:38.723693Z","title":"press/v202/von-oswald23a.html","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.723693Z"},"links":{"cited_paper":"/paper/2406.15708","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:3025a098346bd96a4dad58d02a5d5a587bcd705f54a604d39cab90a54a4c1775","observation_id":"55544b3e-6047-4f8a-823e-e2745b3b2604","resolution":{"observed_at":"2026-08-06T15:20:38.723693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.00330","last_updated":"2025-02-01T06:23:24Z","snapshot_observed_at":"2026-08-04T09:28:53.798314Z","submitted_at":"2025-02-01T06:23:24Z","title":"From Few to Many: Self-Improving Many-Shot Reasoners Through Iterative Optimization and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.00330","snapshot_observed_at":"2026-08-06T15:20:38.727777Z","title":"From few to many: Self-improving many-shot reasoners through iterative optimization and generation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.727777Z"},"links":{"cited_paper":"/paper/2502.00330","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:d741d9bf6d7f9e0582b866cff64548310b9eff0ce52dec7a1e6aa83689a3d6da","observation_id":"c993669c-f7b4-4e3f-b7ec-005ed0ee6eb1","resolution":{"observed_at":"2026-08-06T15:20:38.727777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.12685","last_updated":"2022-10-24T17:44:25Z","snapshot_observed_at":"2026-07-06T13:13:48.138379Z","submitted_at":"2022-05-25T11:45:14Z","title":"Ground-Truth Labels Matter: A Deeper Look into Input-Label Demonstrations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.12685","snapshot_observed_at":"2026-08-06T15:20:38.731801Z","title":"Ground-truth labels matter: A deeper look into input-label demonstrations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.731801Z"},"links":{"cited_paper":"/paper/2205.12685","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:a21a0e1e6ff85d534193cfc310dbc6ba8a6399b6e1884cd13cfd8ca6aaac6e09","observation_id":"32fb9a7a-cbf1-44e8-8f1d-9d213e3fc7df","resolution":{"observed_at":"2026-08-06T15:20:38.731801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.15005","last_updated":"2023-05-24T10:45:25Z","snapshot_observed_at":"2026-08-04T21:30:36.804528Z","submitted_at":"2023-05-24T10:45:25Z","title":"Sentiment Analysis in the Era of Large Language Models: A Reality Check","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.15005","snapshot_observed_at":"2026-08-06T15:20:38.735819Z","title":"Sentiment analysis in the era of large language models: A reality check","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.735819Z"},"links":{"cited_paper":"/paper/2305.15005","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:f429a2def3109723d4d4c535dd447e0117201487b127fe640daf1d622bb869e4","observation_id":"5fa91c2f-1b3f-41cd-8f40-a19b62036401","resolution":{"observed_at":"2026-08-06T15:20:38.735819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.04486","last_updated":"2022-11-08T19:00:02Z","snapshot_observed_at":"2026-07-06T14:15:56.156097Z","submitted_at":"2022-11-08T19:00:02Z","title":"Active Example Selection for In-Context Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.04486","snapshot_observed_at":"2026-08-06T15:20:38.740293Z","title":"Active example selection for in-context learning","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.740293Z"},"links":{"cited_paper":"/paper/2211.04486","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:7f0382aa2115a2bb2bb69169a0f81d6548c5b6ad04d31d58bc1368b3ce8d3b80","observation_id":"bffd6898-4e0f-4945-a8ea-57a087bd2866","resolution":{"observed_at":"2026-08-06T15:20:38.740293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.290020Z","title":"Calibrate before use: Improving few-shot performance of language models","venue":null,"work_id":"d8fd83ec-0942-47b9-891f-2ba60ddac95a","year":2021},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.744147Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:92948b27c7beae945b7339a5f255ad38bf477ebab3611d3a0e3d411a27999557","observation_id":"638c4bec-d0a6-4923-8012-eb74b9cdc59e","resolution":{"observed_at":"2026-08-06T15:20:39.294170Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.276915Z","title":null,"venue":null,"work_id":"78817028-d74d-4459-ae39-7744010b0a67","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.748056Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:56e0c18b930f4b741a831e64ed1032fc463771e688d61877c7e4c37efe0bbd80","observation_id":"22d02d1d-3d86-42eb-b700-5c81082efe2a","resolution":{"observed_at":"2026-08-06T15:20:39.281127Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.249812Z","title":"This portion of the prompt is updated for each downstream test sample","venue":null,"work_id":"22dfae2a-783e-4396-b98f-06d0871053f2","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.755614Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:0c9ae2cd27d68d724569775ca2b509d3e5dd40d589e50d703baf0cdba8622316","observation_id":"74dd82a6-c71b-478f-8116-79edc173a882","resolution":{"observed_at":"2026-08-06T15:20:39.254114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.07544","last_updated":"2024-09-10T20:35:25Z","snapshot_observed_at":"2026-07-06T17:58:43.506575Z","submitted_at":"2024-04-11T08:12:43Z","title":"From Words to Numbers: Your Large Language Model Is Secretly A Capable Regressor When Given In-Context Examples","version":3},"cited_work":{"arxiv_id":"2404.07544","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.07544","snapshot_observed_at":"2026-08-06T15:20:38.891020Z","title":"From Words to Numbers: Your Large Language Model Is Secretly A Capable Regressor When Given In-Context Examples","venue":"cs.CL","work_id":"67008aa3-c0a1-488f-8d44-b99bdc41647e","year":2024},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":1953,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.711643Z"},"links":{"cited_paper":"/paper/2404.07544","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:66167da199199fcf9411413f88cdc00e92d4c435cad2bbfa5e8fbcedcc3cfdf0","observation_id":"c6367907-95b8-43e3-8eae-ccdbdee0014a","resolution":{"observed_at":"2026-08-06T15:20:38.896069Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.263563Z","title":null,"venue":null,"work_id":"49b4822f-db7c-4bdc-8535-a116cdb87935","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":1991,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.751701Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:eac8d2c2e8133b2c3291290408306a021b234f3b8e9a701b053f453d6b21dcc7","observation_id":"614594c2-3630-4643-a80d-70827129b7fd","resolution":{"observed_at":"2026-08-06T15:20:39.267622Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03128","last_updated":"2024-12-04T19:49:02Z","snapshot_observed_at":"2026-07-06T16:27:55.509482Z","submitted_at":"2023-10-04T19:39:26Z","title":"MetaTool Benchmark for Large Language Models: Deciding Whether to Use Tools and Which to Use","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03128","snapshot_observed_at":"2026-08-06T15:20:38.656905Z","title":"Yue Huang, Jiawen Shi, Yuan Li, Chenrui Fan, Siyuan Wu, Qihui Zhang, Yixin Liu, Pan Zhou, Yao Wan, Neil Zhenqiang Gong, and Lichao Sun","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2001,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.656905Z"},"links":{"cited_paper":"/paper/2310.03128","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:a921de837dc46248f2f81dbba15f7195ec7c4cea5826d280fff674c910385e69","observation_id":"22550fcd-f160-4d2f-bbd9-269ad5bc33d1","resolution":{"observed_at":"2026-08-06T15:20:38.656905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.18819","last_updated":"2024-08-02T08:22:57Z","snapshot_observed_at":"2026-07-06T17:37:09.952632Z","submitted_at":"2024-02-29T03:06:10Z","title":"Dual Operating Modes of In-Context Learning","version":2},"cited_work":{"arxiv_id":"2402.18819","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.18819","snapshot_observed_at":"2026-08-06T15:20:38.993363Z","title":"Dual Operating Modes of In-Context Learning","venue":"cs.LG","work_id":"35dab8dd-6843-40f7-9697-1f23c010f48e","year":2024},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2002,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.677270Z"},"links":{"cited_paper":"/paper/2402.18819","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:5903b73ee52e594e36b69fe60eebb20eacf8a61a8aa61fb0204ad6bb09cc304b","observation_id":"82843581-f3b9-4302-b1a0-e522df749fc8","resolution":{"observed_at":"2026-08-06T15:20:38.997554Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.236230Z","title":"That error will be one of the following types: Named Entities: An entity (names, places, locations, etc.) is changed to a different entity","venue":null,"work_id":"cad67ec0-5e54-4a06-b7c6-8f406c078183","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.759814Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:e72b065faf4cf9bb775814de8888dcf2d932118edb26f8a985489ad353d83ad8","observation_id":"66d6077e-d40b-4279-9a62-5657fab0871e","resolution":{"observed_at":"2026-08-06T15:20:39.240685Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.304299Z","title":"Johannes von Oswald, Eyvind Niklasson, Ettore Randazzo, Jo ˜ao Sacramento, Alexander Mordvintsev, Andrey Zhmoginov, and Max Vladymyrov","venue":null,"work_id":"614f9c0c-d54b-4142-9897-e97c9a03d780","year":2017},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.719460Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:565d57ca6dc66a1bafba3a8e2824235fb601cea934a4d39fdb1f1a25d0c52b28","observation_id":"be1332f3-9f33-48a5-8a39-7b5e3d826302","resolution":{"observed_at":"2026-08-06T15:20:39.311194Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.13753","last_updated":"2024-02-21T12:30:33Z","snapshot_observed_at":"2026-08-02T12:47:57.325302Z","submitted_at":"2024-02-21T12:30:33Z","title":"LongRoPE: Extending LLM Context Window Beyond 2 Million Tokens","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.13753","snapshot_observed_at":"2026-08-06T15:20:38.582379Z","title":"Longrope: Extending llm context window beyond 2 million tokens","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.582379Z"},"links":{"cited_paper":"/paper/2402.13753","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:aa2551cfc77e0ae9b2033086b88e2dfa9f176f1152a3d30192c29e87d319d20b","observation_id":"93e6196b-4e58-4f7d-9496-740392bcb826","resolution":{"observed_at":"2026-08-06T15:20:38.582379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08786","last_updated":"2022-03-03T12:10:58Z","snapshot_observed_at":"2026-07-06T11:01:05.577957Z","submitted_at":"2021-04-18T09:29:16Z","title":"Fantastically Ordered Prompts and Where to Find Them: Overcoming Few-Shot Prompt Order Sensitivity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08786","snapshot_observed_at":"2026-08-06T15:20:38.685258Z","title":"Fantastically ordered prompts and where to find them: Overcoming few-shot prompt order sensitivity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.685258Z"},"links":{"cited_paper":"/paper/2104.08786","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:17931431421659915d20f2adf43f2e248bb3ee8890b87306dfd7887c82692c02","observation_id":"346b5bb3-711d-48d8-8423-0d7143312ac8","resolution":{"observed_at":"2026-08-06T15:20:38.685258Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-06T15:20:38.621661Z","title":"Qingxiu Dong, Lei Li, Damai Dai, Ce Zheng, Jingyuan Ma, Rui Li, Heming Xia, Jingjing Xu, Zhiyong Wu, Tianyu Liu, et al","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.621661Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:183eaf0372d46cf581017f5c6b98370bc35829c87e11589fee6442de38d9efed","observation_id":"9cb5e1ab-f374-4131-9d28-70fbe4026869","resolution":{"observed_at":"2026-08-06T15:20:38.621661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.16926","last_updated":"2025-05-28T07:02:54Z","snapshot_observed_at":"2026-07-06T20:11:42.361400Z","submitted_at":"2024-12-22T08:55:19Z","title":"Revisiting In-Context Learning with Long Context Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.16926","snapshot_observed_at":"2026-08-06T15:20:38.184876Z","title":"Revisit- ing in-context learning with long context language models.arXiv preprint arXiv:2412.16926,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.184876Z"},"links":{"cited_paper":"/paper/2412.16926","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:bc29fed121f4ac2ae52acaf7a14dd9e27417a2864c4932d306a817507027d4bd","observation_id":"ca0bdf73-0943-45c6-925d-1c0d4af84acd","resolution":{"observed_at":"2026-08-06T15:20:38.184876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.04835","last_updated":"2023-06-09T02:25:29Z","snapshot_observed_at":"2026-08-03T08:53:00.654354Z","submitted_at":"2023-05-08T16:32:18Z","title":"How Do In-Context Examples Affect Compositional Generalization?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.04835","snapshot_observed_at":"2026-08-06T15:20:38.084083Z","title":"How do in-context examples affect compositional generalization? arXiv preprint arXiv:2305.04835,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.084083Z"},"links":{"cited_paper":"/paper/2305.04835","citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:18b7e12a028416fee5824987da28b785f72434d44aa5c45167d1b952329e626c","observation_id":"456f5d0c-4ed0-4080-8f6c-4114818587dd","resolution":{"observed_at":"2026-08-06T15:20:38.084083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T15:20:39.352681Z","title":"Accessed: 2025-02-13","venue":null,"work_id":"2473feed-6c36-4479-92e3-ed676478025f","year":2025},"citing_paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T15:20:38.644765Z"},"links":{"citing_paper":"/paper/2507.16217"},"observation_digest":"sha256:db3dce67602d80c6298671a43198ce9294733fed6526d5acf613ef4ac22263c5","observation_id":"72d0d03b-efb0-40e1-91c3-d98a02f68f2d","resolution":{"observed_at":"2026-08-06T15:20:39.356892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.16217","last_updated":"2025-08-29T18:45:22Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-06T15:12:57.737368Z","submitted_at":"2025-07-22T04:21:03Z","title":"Towards Compute-Optimal Many-Shot In-Context Learning"},"reference_resolution":{"displayed":43,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":29,"verified_exact":1,"verified_fuzzy":10},"total_outbound_references":43},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 43 of 43 outbound references and 0 inbound Pith citation observations for arXiv:2507.16217."}