{"as_of":"2026-08-16T00:25:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:214a7c58a9ed1eaca28daaf9146bb631a8f02419eade273056574097ba5610cc","coverage":[{"denominator":15,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":15,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T04:05:08.797745Z","state":"measured"},{"denominator":15,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":15,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.22969/citation-record","integrity":"/paper/2607.22969/integrity","json":"/paper/2607.22969/citation-record.json","paper":"/paper/2607.22969"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T04:05:07.627663Z","title":"Language models are few-shot learners,","venue":null,"work_id":null,"year":1901},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:07.627663Z"},"links":{"citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:2b52c0561749fb696ceefd0a099810355e96ed8838bd41ea46378a489b69bb7d","observation_id":"19e0eaea-3e05-4199-814f-e6341c47139f","resolution":{"observed_at":"2026-08-01T04:05:07.627663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-08-13T17:41:53.092611Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-01T04:05:07.691619Z","title":"Scaling laws for neural language models,","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:07.691619Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:9084a5b1a5ebfa113291f824a5abff480f45fde40321d8bb7fcdbc39b6fc36ec","observation_id":"d5579811-861d-4f49-9774-81bad4c22764","resolution":{"observed_at":"2026-08-01T04:05:07.691619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-08-09T19:52:33.533277Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-01T04:05:07.761579Z","title":"Training compute-optimal large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:07.761579Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:1b9b81ec897928b4f6dfc4a5241f6a1b172d0cb702a467a7c92386286bf0a983","observation_id":"b980227d-b516-4dce-8f0c-425ab6d57ca9","resolution":{"observed_at":"2026-08-01T04:05:07.761579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T04:05:07.830616Z","title":"Rethinking the role of demonstrations: What makes in-context learning work?","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:07.830616Z"},"links":{"citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:a06cdd2ca13505674639e5748ee20d093c57a4f1cb8554af6796a40497c636d9","observation_id":"f9fc17ee-2361-4596-ba3f-439b27cd2d39","resolution":{"observed_at":"2026-08-01T04:05:07.830616Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02080","last_updated":"2022-07-21T07:44:13Z","snapshot_observed_at":"2026-08-10T22:45:29.185791Z","submitted_at":"2021-11-03T09:12:33Z","title":"An Explanation of In-context Learning as Implicit Bayesian Inference","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02080","snapshot_observed_at":"2026-08-01T04:05:07.917070Z","title":"An explanation of in-context learning as implicit Bayesian inference,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:07.917070Z"},"links":{"cited_paper":"/paper/2111.02080","citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:0458d826a546a639b001670ee891d8169beb0da7f30c7f351713880d7cb1ec94","observation_id":"34e0c206-ed7f-40ea-9b1e-026586f62c1b","resolution":{"observed_at":"2026-08-01T04:05:07.917070Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T04:05:07.976611Z","title":"Chain-of-thought prompting elicits reasoning in large language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:07.976611Z"},"links":{"citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:85d81e318925ffa220ff1275998bbfceb70033312dd1784c22ad06916789c54d","observation_id":"1fc94f1c-2bb4-4f20-a8f1-36916d6ea0ae","resolution":{"observed_at":"2026-08-01T04:05:07.976611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T04:05:08.084179Z","title":"Calibrate before use: Improving few-shot performance of language models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:08.084179Z"},"links":{"citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:66bc5fdfef265cb720dea2aafc421af19db74213911a07355d3486474e6129b8","observation_id":"f9818dd2-95c4-4185-9c74-018855a172ef","resolution":{"observed_at":"2026-08-01T04:05:08.084179Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T04:05:08.144177Z","title":"Fan- tastically ordered prompts and where to find them: Overcoming few-shot prompt sensitivity with ensemble transfer learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:08.144177Z"},"links":{"citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:fe4e43312fe9cd295ab3688e7e402a056ea2a7f2564f27a4ec07ba79dfe4a39f","observation_id":"bff633c3-b1b0-4a1e-a0c4-8b3d64fd8cf2","resolution":{"observed_at":"2026-08-01T04:05:08.144177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-01T04:05:08.198132Z","title":"A survey for in-context learning,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:08.198132Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:af3274f8e9d402af4026cfaf7197c0ba4723ba70c97d64e18bbbd57a121b1ac3","observation_id":"a095c685-7c32-4a12-97ef-b6527045f256","resolution":{"observed_at":"2026-08-01T04:05:08.198132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.06804","last_updated":"2021-01-17T23:38:40Z","snapshot_observed_at":"2026-08-14T20:40:30.818371Z","submitted_at":"2021-01-17T23:38:40Z","title":"What Makes Good In-Context Examples for GPT-$3$?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.06804","snapshot_observed_at":"2026-08-01T04:05:08.304338Z","title":"What makes good in-context examples for GPT-3?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:08.304338Z"},"links":{"cited_paper":"/paper/2101.06804","citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:55c017f1bd323a102f6aa06b0f3bffac3826b3a637830895e4de909c1cc6aaa7","observation_id":"3a96006a-15e8-47d6-a3d9-5e21235e91c3","resolution":{"observed_at":"2026-08-01T04:05:08.304338Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T04:05:08.463202Z","title":"How to fine-tune BERT for text classification?","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:08.463202Z"},"links":{"citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:e24644ea6e1b8d2da0b2b71a36ebdab9334cd9b387aa8e20ca8a0a96160359c2","observation_id":"52d3957a-105e-4701-a8f9-1df13693869a","resolution":{"observed_at":"2026-08-01T04:05:08.463202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T04:05:08.572817Z","title":"Character-level convolutional networks for text classification,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:08.572817Z"},"links":{"citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:ed9d4541fbcabcec8b42911c5ea8009b6cb0bf8fc25d75a9cee0689e43d546ea","observation_id":"2bcf2c66-11e6-4597-81a2-da6de714613b","resolution":{"observed_at":"2026-08-01T04:05:08.572817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09110","last_updated":"2023-10-01T21:44:23Z","snapshot_observed_at":"2026-08-10T23:10:13.900680Z","submitted_at":"2022-11-16T18:51:34Z","title":"Holistic Evaluation of Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09110","snapshot_observed_at":"2026-08-01T04:05:08.633279Z","title":"Holistic evaluation of language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:08.633279Z"},"links":{"cited_paper":"/paper/2211.09110","citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:1bfb96649175941d25500f17c2499bdd1b1d4766b54b0ddae9a26f50cd41e558","observation_id":"1dc9f541-5391-44e2-8190-8f05dd791d7b","resolution":{"observed_at":"2026-08-01T04:05:08.633279Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.11171","last_updated":"2023-03-07T17:57:37Z","snapshot_observed_at":"2026-07-06T12:50:22.773056Z","submitted_at":"2022-03-21T17:48:52Z","title":"Self-Consistency Improves Chain of Thought Reasoning in Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.11171","snapshot_observed_at":"2026-08-01T04:05:08.737780Z","title":"Self-consistency improves chain of thought reasoning in language models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:08.737780Z"},"links":{"cited_paper":"/paper/2203.11171","citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:bfdf08f70060a268a23fd97cf20482f8fa90d93d1a9ef28515a6247879dfc82c","observation_id":"9654d69b-d43a-42f3-892f-76cd9fd6d13c","resolution":{"observed_at":"2026-08-01T04:05:08.737780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T04:05:08.797745Z","title":"Lost in the middle: How language models use long contexts,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T04:05:08.797745Z"},"links":{"citing_paper":"/paper/2607.22969"},"observation_digest":"sha256:5af3f68f4829b3f18717d69b342ce4695bbedfbcdef11d650e67647d200609d8","observation_id":"f7575ae9-4d0b-4935-8cff-539b7e859031","resolution":{"observed_at":"2026-08-01T04:05:08.797745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.22969","last_updated":"2026-07-25T00:31:40Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-15T22:56:10.307893Z","submitted_at":"2026-07-25T00:31:40Z","title":"When Does Few-Shot Prompting Help? A Systematic Empirical Study of Shot-Count Effects Across Model Scale, Architecture, and Output Parsing Robustness"},"reference_resolution":{"displayed":15,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":15,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":15},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 15 of 15 outbound references and 0 inbound Pith citation observations for arXiv:2607.22969."}