{"as_of":"2026-08-09T02:11:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:99476d80df1a9a6cf37106922068cfdb4996bdb819fcca69bded9318ca40cdda","coverage":[{"denominator":67,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":67,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:24:33.015656Z","state":"measured"},{"denominator":69,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":69,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-12T03:26:41.396467Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T07:21:26.600875Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.19107","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19107","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimization-inspired few-shot adapta- tion for large language models","venue":null,"work_id":"5972c809-e45a-4bc5-bf31-e8ef248ef897","year":2025},"citing_paper":{"arxiv_id":"2605.06117","last_updated":"2026-05-11T01:17:23Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:27:18Z","title":"BoostLLM: Boosting-inspired LLM Fine-tuning for Few-shot Tabular Classification","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T13:50:53.258092Z"},"links":{"cited_paper":"/paper/2505.19107","citing_paper":"/paper/2605.06117"},"observation_digest":"sha256:b71eeb46dae7f51057b3949d3aa736dd11cc25cd677ea4f230673953fcd7687e","observation_id":"7c2603bb-85c0-478b-959b-04c790beb017","resolution":{"observed_at":"2026-05-11T18:51:06.273452Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.19107","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.19107","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Optimization-inspired few-shot adapta- tion for large language models","venue":null,"work_id":"5972c809-e45a-4bc5-bf31-e8ef248ef897","year":2025},"citing_paper":{"arxiv_id":"2605.06117","last_updated":"2026-05-11T01:17:23Z","snapshot_observed_at":"2026-07-06T23:18:36.537416Z","submitted_at":"2026-05-07T12:27:18Z","title":"BoostLLM: Boosting-inspired LLM Fine-tuning for Few-shot Tabular Classification","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T03:26:41.396467Z"},"links":{"cited_paper":"/paper/2505.19107","citing_paper":"/paper/2605.06117"},"observation_digest":"sha256:b2d8f5755f407fe5ec041485f1b65e92708e4aab58ee782e768e78ecb964b2e7","observation_id":"89b917f5-8670-4863-a6e1-85cf89f2f603","resolution":{"observed_at":"2026-05-12T07:21:26.603755Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.19107/citation-record","integrity":"/paper/2505.19107/integrity","json":"/paper/2505.19107/citation-record.json","paper":"/paper/2505.19107"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.665291Z","title":"A mechanism for sample-efficient in-context learning for sparse retrieval tasks","venue":null,"work_id":"7a7b54a1-18b9-42f2-b4b9-b11156e1dd72","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:27.602488Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:0e19bef52aec8ba1b365d10c9cfa6aa2427ccdc01b8d594dc31b4d914653c353","observation_id":"b3559ae4-e06a-4137-bdf3-c905f9054233","resolution":{"observed_at":"2026-08-07T14:24:37.670052Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.651826Z","title":"Second-order stochastic optimization for machine learning in linear time","venue":null,"work_id":"5056e9ea-b2c7-4767-9758-22df6c162cb1","year":2017},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:27.698902Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:e7d5ac90188fe589a483ffbf76b25dae0b91233aa586a8a8791eee14f6720148","observation_id":"be2125a8-fded-47dc-80b3-300853d3e6dc","resolution":{"observed_at":"2026-08-07T14:24:37.656014Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.639187Z","title":"Transformers learn to implement preconditioned gradient descent for in-context learning","venue":null,"work_id":"bc519e0c-a23a-444a-bed0-2142938302b2","year":2023},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:27.826334Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:dee632b08a7aecc0b089cfd39875263309dae83a5b70297948d7dc21cd62ce1d","observation_id":"2778b413-1326-4a07-9a8b-c17655a313e0","resolution":{"observed_at":"2026-08-07T14:24:37.643060Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.625263Z","title":"What learning algorithm is in-context learning? investigations with linear models","venue":null,"work_id":"ec11727b-6589-469c-adcb-fb32f2937156","year":2023},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:27.904098Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:5a112fd2074b3af5093ed408d8956e6d81790da4f6e9e41627dd7cb5c41a5f35","observation_id":"a92eb846-6a8c-4540-b8ef-30f8a3d12db0","resolution":{"observed_at":"2026-08-07T14:24:37.630796Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:28.036807Z","title":"Flamingo: a visual language model for few-shot learning","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.036807Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:29f4c2bd563e2fded53d8d1e8ba18d0c94e0e7454f4879e9ddaf400be7eaf785","observation_id":"9e6eab1d-22fa-4373-a9b6-19daa395dde3","resolution":{"observed_at":"2026-08-07T14:24:28.036807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.606502Z","title":"Infinite mixture prototypes for few-shot learning","venue":null,"work_id":"6d78fd9c-02d6-4506-b9d7-d01cd822b2ec","year":2019},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.150409Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:305217f15ef264d217e0e4574128577f20957c930e3a08dc901ec5130040b60a","observation_id":"c44bf5d5-7e7e-4a5f-9b8d-3ef6da1955cc","resolution":{"observed_at":"2026-08-07T14:24:37.610870Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.593862Z","title":"Transformers as statisticians: Provable in-context learning with in-context algorithm selection","venue":null,"work_id":"69b055e2-5f92-477f-925c-3a788cc6b18e","year":2023},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.192470Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:e7df6fee3c0a76210321bed423f71ad6f599a62c063390b11e2ae091816383c9","observation_id":"9df63e4e-dcaa-4e22-b686-5f059bff7785","resolution":{"observed_at":"2026-08-07T14:24:37.597886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.582090Z","title":null,"venue":null,"work_id":"b45c613f-b785-4221-abbf-b1af0493922d","year":2020},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.349126Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:63610cf529306bd63f0cdf46530b05ac03d3ed6aa0e908de542751bc0ca4571c","observation_id":"ffb8f333-b820-4383-9946-0686909be4c9","resolution":{"observed_at":"2026-08-07T14:24:37.585671Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.15818","last_updated":"2023-07-28T21:18:02Z","snapshot_observed_at":"2026-08-02T16:17:50.621617Z","submitted_at":"2023-07-28T21:18:02Z","title":"RT-2: Vision-Language-Action Models Transfer Web Knowledge to Robotic Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.15818","snapshot_observed_at":"2026-08-07T14:24:28.436507Z","title":"Rt-2: Vision-language-action models transfer web knowledge to robotic control","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.436507Z"},"links":{"cited_paper":"/paper/2307.15818","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:df69b76e7f9519ef66b98bbe2c3e945dfc3ec05b6e7187fbdf50cf15cad33fd3","observation_id":"c5bb5ffd-c4a7-402e-9a0b-8532699bf7af","resolution":{"observed_at":"2026-08-07T14:24:28.436507Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:28.504538Z","title":"Language models are few-shot learners","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.504538Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:2e08dc9905bc2294107c798e15ebf6df0c16d7712b5abfb36768618c6dd3aa43","observation_id":"d7f14e89-b0f5-4f72-880f-ae25ac339cc5","resolution":{"observed_at":"2026-08-07T14:24:28.504538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.562393Z","title":"Semeval- 2019 task 3: Emocontext contextual emotion detection in text","venue":null,"work_id":"9a602114-700a-423e-9ace-019e8a5c53a2","year":2019},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.609259Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:6ad66a19d3ab92569878f679f3b8169ede47eaa370e103e72d7bbbd996513c69","observation_id":"1be7ff25-ccdf-4177-b660-d598468b753d","resolution":{"observed_at":"2026-08-07T14:24:37.566847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.549784Z","title":"Evaluating large language models trained on code","venue":null,"work_id":"9b2b3c8c-7189-4ed1-8097-cdddaf8765f6","year":2021},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.697209Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:ba500f678d82f3529240c40b293f15f1447632e2a07c15a7e720669a18efec45","observation_id":"c991737d-a3d7-4c07-8727-662515b5901a","resolution":{"observed_at":"2026-08-07T14:24:37.554476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.535640Z","title":"Training verifiers to solve math word problems","venue":null,"work_id":"f0078e2a-6a35-4377-8937-3a77092f7a09","year":2021},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.727178Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:7854e147e82eadd5133949664cfd8fbf13ef943feed78b727f5086ccddc55294","observation_id":"fd930ef6-9930-436e-9165-206f35a1e2fb","resolution":{"observed_at":"2026-08-07T14:24:37.540726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.10559","last_updated":"2023-05-15T11:45:12Z","snapshot_observed_at":"2026-08-04T19:53:52.631474Z","submitted_at":"2022-12-20T18:58:48Z","title":"Why Can GPT Learn In-Context? Language Models Implicitly Perform Gradient Descent as Meta-Optimizers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.10559","snapshot_observed_at":"2026-08-07T14:24:28.780094Z","title":"Why can gpt learn in-context? language models implicitly perform gradient descent as meta-optimizers","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.780094Z"},"links":{"cited_paper":"/paper/2212.10559","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:e0cd685c9dfaf3441e07743887f80c205eb76dba409d41778874fbba6f613e3e","observation_id":"3b5f9650-bca0-4ed6-b0b5-4582b762fb54","resolution":{"observed_at":"2026-08-07T14:24:28.780094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.04444","last_updated":"2018-09-12T13:51:02Z","snapshot_observed_at":"2026-07-06T07:00:48.332422Z","submitted_at":"2018-09-12T13:51:02Z","title":"Hate Speech Dataset from a White Supremacy Forum","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.04444","snapshot_observed_at":"2026-08-07T14:24:28.824848Z","title":"Hate speech dataset from a white supremacy forum","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.824848Z"},"links":{"cited_paper":"/paper/1809.04444","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:b7378182caee6ade063132c04891ae83a25aa91a07d46b28f9f7e7b7fce18188","observation_id":"fe8aebae-eb7c-4b2e-ade4-f0e2c8900241","resolution":{"observed_at":"2026-08-07T14:24:28.824848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.524197Z","title":"Sharp minima can generalize for deep nets","venue":null,"work_id":"813f9466-d9a5-4b78-951f-9eb0e4291d27","year":2017},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:28.890072Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:d7aab13b9e2bbc2b071dd7923323fc790258003e47ae092ff377e00cbcc4cbfb","observation_id":"f2c11d43-6914-4740-b177-cf1b2a320d15","resolution":{"observed_at":"2026-08-07T14:24:37.527920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.510970Z","title":"Incorporat- ing second-order functional knowledge for better option pricing","venue":null,"work_id":"71fe508f-a1ce-4c22-86d1-4f972e381ef2","year":2000},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.000591Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:44cc9de2fe960b7ad48c7c46e2843a1cee94c0834cac57ed88612779e437a4f4","observation_id":"bf6eca25-568f-4e73-870a-3ebadee35583","resolution":{"observed_at":"2026-08-07T14:24:37.515769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1703.11008","last_updated":"2017-10-19T03:39:56Z","snapshot_observed_at":"2026-07-06T05:36:05.666091Z","submitted_at":"2017-03-31T17:56:41Z","title":"Computing Nonvacuous Generalization Bounds for Deep (Stochastic) Neural Networks with Many More Parameters than Training Data","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1703.11008","snapshot_observed_at":"2026-08-07T14:24:29.112309Z","title":"Computing nonvacuous generalization bounds for deep (stochastic) neural networks with many more parameters than training data","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.112309Z"},"links":{"cited_paper":"/paper/1703.11008","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:8bfd083deb05079f5821e3049eb2261769158e02c6d709bdd35f0e5e87a9efcd","observation_id":"bcd2a03d-5fae-4ca1-8a45-bc4fe1d40554","resolution":{"observed_at":"2026-08-07T14:24:29.112309Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.498146Z","title":"Model-agnostic meta-learning for fast adapta- tion of deep networks","venue":null,"work_id":"f306019e-79f5-4133-a216-4a8c0dda2ad2","year":2017},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.172896Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:d4a5421f16166e1e90d0ba2396ae2a46a6a06dd5d59ab788f1bcf65f12c56bb2","observation_id":"63a8df59-4ce2-411f-b205-7db3ec5ddb99","resolution":{"observed_at":"2026-08-07T14:24:37.502031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.485009Z","title":"Rusu, Razvan Pascanu, Francesco Visin, Hujun Yin, and Raia Hadsell","venue":null,"work_id":"564a242e-f525-49bb-82d4-83304a492e29","year":2020},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.315366Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:c37a0cb6be6bfbb1cce35d3c088621280b2b60d021afd58c0b795bd3bb280054","observation_id":"5fd7dcff-6d41-4e3f-8dad-30e156aec4ef","resolution":{"observed_at":"2026-08-07T14:24:37.489731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.471434Z","title":"Sharpness-aware mini- mization for efficiently improving generalization","venue":null,"work_id":"dbe86f49-3ed9-40fd-a8b8-768d64a52d1f","year":2021},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.410395Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:1cdb73ecd74f30bb88a14d185e6e9bc71183045d30b192c2a7476587e9a852f2","observation_id":"0cf7c002-fe86-4cbf-ad5a-d6c46620037c","resolution":{"observed_at":"2026-08-07T14:24:37.475953Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.01367","last_updated":"2024-10-03T02:43:59Z","snapshot_observed_at":"2026-08-06T11:28:59.629862Z","submitted_at":"2024-08-02T16:21:48Z","title":"Transformers are Universal In-context Learners","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.01367","snapshot_observed_at":"2026-08-07T14:24:29.448423Z","title":"Transformers are universal in-context learners","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.448423Z"},"links":{"cited_paper":"/paper/2408.01367","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:f2b84c1b688407aa490cfe01f6e83a10b5cc23e4847e8c67029986f3766b5241","observation_id":"cdbea759-9a17-480e-adf0-c471a07c1ee6","resolution":{"observed_at":"2026-08-07T14:24:29.448423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.458143Z","title":"The impact of initialization on lora finetuning dynamics","venue":null,"work_id":"a9c0e3a5-8d23-4695-a930-e407aab0be00","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.476977Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:ffb3d1a21e40fe14d6c29725e03c1856dbd952499aaa5e109e2a8990c7f17a72","observation_id":"0cac3aeb-752d-41f0-995a-884dce0d5f2b","resolution":{"observed_at":"2026-08-07T14:24:37.463028Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.444987Z","title":"In-context learning creates task vectors","venue":null,"work_id":"c9424d81-aa72-4a41-bb39-cb57bef90bb7","year":2023},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.551609Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:f3c975e8de0384d215602ad0d1a8efa7b62a41a04bccb447feab21899b4a6613","observation_id":"dd8d1cc6-9d43-4609-8a53-25e9fdcf92de","resolution":{"observed_at":"2026-08-07T14:24:37.449763Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:29.647587Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.647587Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:289a1ad4de67db44135502cbd5771060725e8f63b7e13ca5a3be29920e4cfb5d","observation_id":"48aeb200-adee-4d25-b54a-cb232853cd94","resolution":{"observed_at":"2026-08-07T14:24:29.647587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.423554Z","title":"Transformers are minimax optimal nonparametric in-context learners","venue":null,"work_id":"f5a905f4-6248-4e10-93b5-3a154761e5e7","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.733351Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:a3ca41e8c37d573d51e0c283511bb5c9de579b9035c4204e3cf93fd7e8de76b3","observation_id":"ff4dfc64-afe9-46d9-93a9-0fa4a117bc95","resolution":{"observed_at":"2026-08-07T14:24:37.427739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.412731Z","title":"Asam: Adaptive sharpness-aware minimization for scale-invariant learning","venue":null,"work_id":"5619f82e-51ae-434d-93de-a46eb23c28d3","year":2021},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.775398Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:63f98fc1b773727715bfbc451b65d7fe5b675e3830b0d932970c7cc3b957c97b","observation_id":"898888f2-67d7-4323-8e31-beadde182e38","resolution":{"observed_at":"2026-08-07T14:24:37.416208Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.402084Z","title":"Dbpedia–a large-scale, multilingual knowledge base extracted from wikipedia","venue":null,"work_id":"5a3ffc25-c9b5-4479-99c3-737d3f3dac0a","year":2015},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.837428Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:ff05d180284389529ccd0e3f2cc861dda7cae22458a3fb3b4b1925f514127294","observation_id":"32e71d81-f450-4a61-a288-c910223eff1b","resolution":{"observed_at":"2026-08-07T14:24:37.405629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.08691","last_updated":"2021-09-02T17:34:41Z","snapshot_observed_at":"2026-08-06T15:24:34.790850Z","submitted_at":"2021-04-18T03:19:26Z","title":"The Power of Scale for Parameter-Efficient Prompt Tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2104.08691","snapshot_observed_at":"2026-08-07T14:24:29.946989Z","title":"The power of scale for parameter-efficient prompt tuning","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:29.946989Z"},"links":{"cited_paper":"/paper/2104.08691","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:0d9cae0ecd6d0a35c6352c8afd0502ca2de6f8ef3167704f4600b75a7fafc384","observation_id":"3c5830a0-d947-4e2a-95b8-851e10420d52","resolution":{"observed_at":"2026-08-07T14:24:29.946989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.391469Z","title":"In-context learning state vector with inner and momentum optimization","venue":null,"work_id":"4a257eca-a65b-4a87-9be1-7bb5e334577a","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.039412Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:0360b1dac93f7c8481b5231b4ba2496eccc345ed3a8f5b5e54333bb19aa871f6","observation_id":"8080f72c-c72b-44d9-b91b-0a835f55ddbe","resolution":{"observed_at":"2026-08-07T14:24:37.395186Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.381348Z","title":"Learning question classification with support vector machines, 2002","venue":null,"work_id":"af23c4f0-7687-47fb-9e0b-bd11df6497f2","year":2002},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.111250Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:7c70dd5fd00f40d4cc598794bc8d69c0498798285bca21a685b3589fe41b42cb","observation_id":"5d70d02e-8dea-4d80-b81a-5fdc020fe475","resolution":{"observed_at":"2026-08-07T14:24:37.385010Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.09835","last_updated":"2017-09-28T15:59:41Z","snapshot_observed_at":"2026-07-06T05:53:24.061473Z","submitted_at":"2017-07-31T13:08:11Z","title":"Meta-SGD: Learning to Learn Quickly for Few-Shot Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.09835","snapshot_observed_at":"2026-08-07T14:24:30.183818Z","title":"Meta-sgd: Learning to learn quickly for few-shot learning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.183818Z"},"links":{"cited_paper":"/paper/1707.09835","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:08a6d6c9605c844e7d99984a5c6c56891097c0966bf22b01d1bbc0b3ad74fedd","observation_id":"8139911d-4b87-42a7-9fc3-bbe236485f2b","resolution":{"observed_at":"2026-08-07T14:24:30.183818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.353043Z","title":null,"venue":null,"work_id":"1e1d3af7-5f11-428a-b706-470a9a3edf33","year":2025},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.240097Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:0fe96adb84393095972cdb6da910638efe9030b60b43e7c3c9eb3ce946a86677","observation_id":"2f88aa79-55e5-4f9d-8f19-7a738db78507","resolution":{"observed_at":"2026-08-07T14:24:37.369716Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:37.150856Z","title":"Few-shot parameter-efficient fine-tuning is better and cheaper than in-context learning","venue":null,"work_id":"7d98fc44-b471-44d2-8239-4601d6268a76","year":2022},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.441290Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:393723eaee73e4248faa284f0862cc4f8fc34803aaf211faf4b635217209076e","observation_id":"4d314b92-62f4-4461-925c-51ee0e87441e","resolution":{"observed_at":"2026-08-07T14:24:37.253215Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:36.872966Z","title":"DoRA: Weight-decomposed low-rank adaptation","venue":null,"work_id":"60e634c7-8f05-4d65-9325-7c1f520f26ee","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.488957Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:d1f545deea6e4772b568eff190bf8ad597addc3388e813ac007725cd15ce6c0b","observation_id":"2c9c90b5-3843-4afe-bbb1-715f056d3a18","resolution":{"observed_at":"2026-08-07T14:24:36.954523Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:36.762263Z","title":"Codet: Code generation with generated tests","venue":null,"work_id":"ac8873bf-3708-441c-9535-b3c0bfb39f1d","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.572258Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:ffa2a38ea01cf6ad41db5ef7274bffd886a5e8569a512381d4e985342141561a","observation_id":"df521e17-68c3-49c5-8af8-72e04c221c02","resolution":{"observed_at":"2026-08-07T14:24:36.812017Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:36.549244Z","title":"Self-refine: Iterative refinement with self-feedback","venue":null,"work_id":"be789ed1-fb71-43da-b709-bbf940f23fc7","year":2023},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.698891Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:369ba42b00ce58a5eef710911d9d33b48656f25fc97cfbb9304e4a7ceca96f21","observation_id":"69bc6131-fffc-4fd7-a1da-ab718081f0b0","resolution":{"observed_at":"2026-08-07T14:24:36.663307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:36.417772Z","title":"Pissa: Principal singular values and singular vectors adaptation of large language models","venue":null,"work_id":"b6ee6078-49ca-473b-b1c6-533ef12b7627","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.774881Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:ef8dd66873666581df4a127c4ab21b116390c9e5837665890820820c92b0c2cf","observation_id":"df5f7737-ea00-4511-b333-aa8be7d87ae7","resolution":{"observed_at":"2026-08-07T14:24:36.497835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:36.226086Z","title":"A PAC-bayesian approach to spectrally-normalized margin bounds for neural networks","venue":null,"work_id":"803493ba-a3dd-4dae-8e5e-ceff9492faf7","year":2018},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.824936Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:ee1dbf94a428a6e03bc972e402bc5b9f4d538b1e301f96fed9b2451ffe1cb591","observation_id":"3d213692-540a-4ccb-a12f-d2f80fbf9352","resolution":{"observed_at":"2026-08-07T14:24:36.295747Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1803.02999","last_updated":"2018-10-22T16:11:14Z","snapshot_observed_at":"2026-08-05T12:53:31.632675Z","submitted_at":"2018-03-08T08:29:38Z","title":"On First-Order Meta-Learning Algorithms","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.02999","snapshot_observed_at":"2026-08-07T14:24:30.913450Z","title":"Reptile: a scalable metalearning algorithm","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:30.913450Z"},"links":{"cited_paper":"/paper/1803.02999","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:dbc1da9fa2fb371f4146ae8843ae25dfae8f84eb46ac087ea771dbccb8ac87ad","observation_id":"58dd585a-6d4d-4c54-aef6-a68669ea6d99","resolution":{"observed_at":"2026-08-07T14:24:30.913450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:36.106764Z","title":"A sentimental education: Sentiment analysis using subjectivity summarization based on minimum cuts","venue":null,"work_id":"05a89183-ee73-4354-a8b4-473ae53ef1da","year":2004},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.038215Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:ef405ecdf4e40b67410e5a61ff20a86b678c9a661302548a2d46b77b6805a264","observation_id":"7c42ad8b-07bd-4d4d-ab81-cc20050e76da","resolution":{"observed_at":"2026-08-07T14:24:36.171198Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:35.862770Z","title":"Seeing stars: Exploiting class relationships for sentiment categorization with respect to rating scales","venue":null,"work_id":"eef6b284-5b1c-4d9b-99d0-c302a8aa980c","year":2005},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.081981Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:25e4c2bffccb847feae2b376249c51eb50109a0a2666a33eb20493239b735e4a","observation_id":"47967231-1b46-4bda-8e0c-76f3d9e7328b","resolution":{"observed_at":"2026-08-07T14:24:35.956375Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:35.584833Z","title":"Meta-curvature","venue":null,"work_id":"fde55a73-3608-42b8-b9d2-42ec4420fd73","year":2019},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.117085Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:3f1d4caa1c6ce4fe5ce8a6a3bca919096d18896eba062efb28f6f99cf2f150ba","observation_id":"4684f72b-906d-47af-92d8-5fc8c9f9cce4","resolution":{"observed_at":"2026-08-07T14:24:35.747673Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:35.488109Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":"8d5e0ada-bf72-4334-8aaa-cb123135d0e2","year":null},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.184883Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:d39c16cb8ad3eaf849370f948ca618d7892cd8d29c7972683b17fb4b52b2bb5d","observation_id":"20dea83b-dc9f-44d1-a076-fae024e2c4d7","resolution":{"observed_at":"2026-08-07T14:24:35.533381Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:31.337418Z","title":"Language models are unsupervised multitask learners","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.337418Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:11718ff0301c4c075f5cda5ecdefff396053c31beff5e0749534e728ba48ca90","observation_id":"7f23ea0a-7d4a-4619-91e0-86a0a66510ec","resolution":{"observed_at":"2026-08-07T14:24:31.337418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:35.217037Z","title":"Meta-learning with implicit gradients","venue":null,"work_id":"e563852e-6237-4c81-a988-7f28db985269","year":2019},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.402406Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:18d19c1a35bfa3c0fa613facf98eade6c34cccc0f970be24fac36c087a2e91a1","observation_id":"932cc528-38b8-40f6-898a-ececca334321","resolution":{"observed_at":"2026-08-07T14:24:35.225813Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19328","last_updated":"2023-05-30T18:00:11Z","snapshot_observed_at":"2026-07-06T15:35:37.778184Z","submitted_at":"2023-05-30T18:00:11Z","title":"Studying the link between radio galaxies and AGN fuelling with relativistic hydrodynamic simulations of flickering jets","version":1},"cited_work":{"arxiv_id":"2305.19328","doi":null,"metadata_source":"pith","pith_arxiv_id":"2305.19328","snapshot_observed_at":"2026-08-07T14:24:33.301111Z","title":"Studying the link between radio galaxies and AGN fuelling with relativistic hydrodynamic simulations of flickering jets","venue":"astro-ph.HE","work_id":"b44c003e-15a6-4877-9651-4147a78ec56c","year":2023},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.496652Z"},"links":{"cited_paper":"/paper/2305.19328","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:bdc5542c2c03acf528313624a8964a51d385dce9ec00e089a90d4caafe8ee253","observation_id":"7f426ed3-8e94-47f7-bdae-7b24c7000e79","resolution":{"observed_at":"2026-08-07T14:24:33.345186Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.13138","last_updated":"2022-12-26T14:28:24Z","snapshot_observed_at":"2026-07-06T14:35:02.598037Z","submitted_at":"2022-12-26T14:28:24Z","title":"Large Language Models Encode Clinical Knowledge","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.13138","snapshot_observed_at":"2026-08-07T14:24:31.620921Z","title":"Large language models encode clinical knowledge","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.620921Z"},"links":{"cited_paper":"/paper/2212.13138","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:a85514ee0e77291b9db4adae604b3a986bae0a076fb850bb1a4b700c3277daca","observation_id":"91f49d6f-26ff-4bbe-b62b-e91e0e6857e9","resolution":{"observed_at":"2026-08-07T14:24:31.620921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:35.059517Z","title":"Prototypical networks for few-shot learning","venue":null,"work_id":"f2915570-6e46-46ca-ae0e-02f65c2f51ab","year":2017},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.661186Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:11807b3e955480e04ee3cc579c5a98f332d25f6126b1d5b3517039e6acafef19","observation_id":"79d1aaf4-f42d-47d8-a172-654804e65f44","resolution":{"observed_at":"2026-08-07T14:24:35.139660Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:34.970460Z","title":"Recursive deep models for semantic compositionality over a sentiment treebank","venue":null,"work_id":"27289fb5-5a90-4da4-b23b-d2e369a6fe7d","year":2013},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.714048Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:2d7b94804c0f521df10a5d7eb09c9cf71e5da4eaf9592c964dc2b372f41e22a9","observation_id":"efe61a5f-be97-4f44-89ce-7b42c25fc644","resolution":{"observed_at":"2026-08-07T14:24:34.999850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:34.867800Z","title":"Learning to compare: Relation network for few-shot learning","venue":null,"work_id":"87c33886-3584-4d1f-9e1f-6eb0fd3de0cc","year":2018},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.765749Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:a369f9b7563b9c36eeba4b28321f570cf422641cab24948acd23176e4f69692f","observation_id":"63811d55-222b-4bad-b7ff-e5ab1c90fcc0","resolution":{"observed_at":"2026-08-07T14:24:34.929774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T14:24:31.889012Z","title":"de la Cerda, John Dodson, Kyle Kosic, Thomas Lavril, Matthew Leavitt, Jenia Jitsev, and Gabriel Lample","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.889012Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:e261824bfc7d195a5d6c3defe28a9fe31c57608cad293304e73e8a742fa13b58","observation_id":"59c6b209-efd1-452c-b3a0-6bf06c431ff8","resolution":{"observed_at":"2026-08-07T14:24:31.889012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.06734","last_updated":"2024-07-13T23:30:29Z","snapshot_observed_at":"2026-07-06T17:58:05.136931Z","submitted_at":"2024-04-10T04:40:48Z","title":"Dismai-Bench: Benchmarking and designing generative models using disordered materials and interfaces","version":2},"cited_work":{"arxiv_id":"2404.06734","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.06734","snapshot_observed_at":"2026-08-07T14:24:33.087292Z","title":"Dismai-Bench: Benchmarking and designing generative models using disordered materials and interfaces","venue":"cond-mat.mtrl-sci","work_id":"355cbffd-f287-4583-aa18-4566820527a3","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.983217Z"},"links":{"cited_paper":"/paper/2404.06734","citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:75a1e2ca4302f036bca2760a53fd299ce985d3b49a4a73a09bef81c4162a9bae","observation_id":"2f644fd8-33d0-4bb1-8f05-b9aec057f00a","resolution":{"observed_at":"2026-08-07T14:24:33.196786Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:34.712581Z","title":"Matching networks for one shot learning","venue":null,"work_id":"e7d0fdf7-2083-4d72-856d-51ceed0f7d6f","year":2016},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.062877Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:59c1873e62f827827e30d3e4d598d41272b07f3c4dcba89c3e902b11d93cbbc7","observation_id":"f1fbde41-6c3a-48a7-b0a9-e602427187a3","resolution":{"observed_at":"2026-08-07T14:24:34.769100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:34.633578Z","title":"Transformers learn in-context by gradient descent","venue":null,"work_id":"92a76955-e99a-4836-a173-2e65b92b9bee","year":2023},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.118324Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:79ce617d6af1e439af585da0370a353cf86d8bca7fc4b3810e313e88d03ea111","observation_id":"ad8b4c03-c6ac-4c7b-8824-b90fad6122fb","resolution":{"observed_at":"2026-08-07T14:24:34.665309Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:34.485836Z","title":"Label words are anchors: An information flow perspective for understanding in-context learning","venue":null,"work_id":"b0d85853-0e2b-4048-99c5-91e36e650276","year":2023},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.226320Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:1d56e1c51483938684fe94ba61f2d1bfd9ddcc67b27807c5690cb13de3287caa","observation_id":"26fb3251-a41c-451b-be36-9e828975cda4","resolution":{"observed_at":"2026-08-07T14:24:34.568691Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:34.369936Z","title":"Do prompt-based models really understand the meaning of their prompts? In NAACL, 2022","venue":null,"work_id":"0b157965-5dc1-43ac-942f-7e2e82eb553d","year":2022},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.313856Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:da95a0f229bc05ff5003e23f89bb9fbc46b94e225e912badbccab97c9dbdaf52","observation_id":"8c2fe295-f69c-449f-aa74-a77fa6fafbb8","resolution":{"observed_at":"2026-08-07T14:24:34.430207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:34.250796Z","title":"Chain of thought prompting elicits reasoning in large language models","venue":null,"work_id":"f7afe3a7-4b01-45b9-83e5-34a57b7c0894","year":2022},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.409286Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:8867e2b13c74691dde3522b91a16d29c96a717ab0456332160cfe8f1a8d7f95b","observation_id":"573f2202-3972-410c-a744-7f7e05de7997","resolution":{"observed_at":"2026-08-07T14:24:34.316363Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:34.104131Z","title":"How many pretraining tasks are needed for in-context learning of linear regression? In ICLR, 2024","venue":null,"work_id":"ca4de6e0-30f3-4db9-8e27-5855e6ab6b38","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.470031Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:5426e1a5372c4155cb4063fbbfee57bba7332ee0a784306510be2497ed50b557","observation_id":"d3761583-981b-45a7-b817-5b0202be0541","resolution":{"observed_at":"2026-08-07T14:24:34.166242Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:34.024943Z","title":"Corda: Context-oriented decomposition adaptation of large language models for task-aware parameter-efficient fine-tuning","venue":null,"work_id":"a58d2832-74b0-40ed-8244-7a4f3ba8cae6","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.556913Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:2b22f02fbcbcd8464a386ad85c1069ae88207e56f0adbabaa989c8c3c0c12a10","observation_id":"5264202b-5fb9-4930-814b-4583529d89ec","resolution":{"observed_at":"2026-08-07T14:24:34.065824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:33.873550Z","title":"Free lunch for few-shot learning: Distribution calibration","venue":null,"work_id":"4421a219-5a34-45e9-a940-40e4e2206dcc","year":2021},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.676487Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:1f88594a82934f424b13faa5a4082767bd71c9b5e768456f90e4552614104738","observation_id":"e9633d1b-1b47-4833-94bc-598158bd88d6","resolution":{"observed_at":"2026-08-07T14:24:33.961554Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:33.753820Z","title":"Improving generalization by controlling label-noise information in neural network weights","venue":null,"work_id":"936c3b41-2137-4e7a-b811-8258a51740c8","year":2022},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.706506Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:332069ac253ce07fcdfa925970d42eee39a290effd7b6d83f27183ea9b2d0059","observation_id":"2a81cc69-cefe-488b-95e1-0d21eae7e3dd","resolution":{"observed_at":"2026-08-07T14:24:33.807182Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:33.648197Z","title":"In-context learning of a linear transformer block: benefits of the mlp component and one-step gd initialization","venue":null,"work_id":"26622e2d-a982-4ab3-927b-d32bc6585192","year":2024},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.744636Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:508f556f55c8e283635bf8a153b936dfcca64717dde6ffd999c04e6eaaa2487b","observation_id":"64e0ab43-c59c-4348-a6ec-cb7aaf8dcca2","resolution":{"observed_at":"2026-08-07T14:24:33.706473Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:32.783537Z","title":"Character-level convolutional networks for text classification","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.783537Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:cb9a7eb356b1e08e3644f6246f5837feaac30c40eca454ff3b051022b056707a","observation_id":"73b9388a-dd11-47f0-9862-2d087be3685d","resolution":{"observed_at":"2026-08-07T14:24:32.783537Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:32.901928Z","title":"Calibrate before use: Improving few-shot performance of language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:32.901928Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:75e5b477001cf35bbda4142ff690884bb760c8a3029070678c5d51ebdbb028ec","observation_id":"7ac638d4-512b-4247-8c8f-1f910a9ef528","resolution":{"observed_at":"2026-08-07T14:24:32.901928Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:33.498766Z","title":"Dvornek, Sekhar Tatikonda, James S","venue":null,"work_id":"9d509e87-8115-4fc8-8499-61435d09cd88","year":2022},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:33.015656Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:c35e77cc10f0f70835871e22467b155f98b1d0f56d6eb2a5d1d58539c51c98b3","observation_id":"dd90d013-447f-4c98-9bba-edc3ea3cfde4","resolution":{"observed_at":"2026-08-07T14:24:33.557983Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:24:35.265219Z","title":null,"venue":null,"work_id":"edb9049c-7062-4c5a-b291-39de7df52a33","year":null},"citing_paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models","version":1},"reference_index":2019,"source":"pdf_text","source_observed_at":"2026-08-07T14:24:31.278503Z"},"links":{"citing_paper":"/paper/2505.19107"},"observation_digest":"sha256:96cab3d5144f1d03c71430ca49af1135d8e053f81a42bd3209213f593ca222a6","observation_id":"5f4a2958-dc63-45be-9a3a-b7f4a79f7b5c","resolution":{"observed_at":"2026-08-07T14:24:35.326589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19107","last_updated":"2025-05-25T11:54:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-07T14:18:01.516567Z","submitted_at":"2025-05-25T11:54:23Z","title":"Optimization-Inspired Few-Shot Adaptation for Large Language Models"},"reference_resolution":{"displayed":67,"state_counts":{"malformed_identifier":1,"metadata_mismatch":2,"parse_uncertain":0,"unresolved":19,"verified_exact":0,"verified_fuzzy":45},"total_outbound_references":67},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 67 of 67 outbound references and 2 inbound Pith citation observations for arXiv:2505.19107."}