{"as_of":"2026-08-13T08:38:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1c280bc94af341fc8456ee18976f4f7c716493c52318d03998c23978c95bc7ce","coverage":[{"denominator":29,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":29,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T18:35:15.937810Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-13T06:32:02.005865+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-18T21:58:28.070835Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-18T22:01:52.055202Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"cited_work":{"arxiv_id":"2411.11465","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.11465","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv:2411.11465 [cs.LG]","venue":null,"work_id":"df90f1fd-f854-4c64-8868-c3e9f8da8241","year":2019},"citing_paper":{"arxiv_id":"2508.14685","last_updated":"2026-05-10T08:06:04Z","snapshot_observed_at":"2026-08-11T08:56:40.879122Z","submitted_at":"2025-08-20T13:01:34Z","title":"SSA: Improving Performance With a Better Scoring Function","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-18T21:58:28.070835Z"},"links":{"cited_paper":"/paper/2411.11465","citing_paper":"/paper/2508.14685"},"observation_digest":"sha256:7f1a2eb3828e374b149030fe3ca2a8b7cda5bc2388498c5d540783ecf3c6e8ac","observation_id":"08f442f4-d579-4305-ac03-eef7104ee17b","resolution":{"observed_at":"2026-05-18T22:01:52.057797Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"cited_work":{"arxiv_id":"2411.11465","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2411.11465","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"ArXiv:2411.11465 [cs.LG]","venue":null,"work_id":"df90f1fd-f854-4c64-8868-c3e9f8da8241","year":2019},"citing_paper":{"arxiv_id":"2509.04470","last_updated":"2026-05-03T21:48:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-29T11:15:57Z","title":"COCORELI: Enforcing Execution Preconditions for Reliable Collaborative Instruction Following","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-18T20:47:48.667101Z"},"links":{"cited_paper":"/paper/2411.11465","citing_paper":"/paper/2509.04470"},"observation_digest":"sha256:26bedf7b647bb44edadb444a19f8cd044a4325d89244a228d1f7068bdc6dd4d0","observation_id":"c2ff436c-a8a2-4492-baa4-d5a7cd049f63","resolution":{"observed_at":"2026-05-18T20:51:50.915957Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2411.11465/citation-record","integrity":"/paper/2411.11465/integrity","json":"/paper/2411.11465/citation-record.json","paper":"/paper/2411.11465"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.569615Z","title":"Advances in Neural Information Processing Systems 36, 45614–45650 (2023)","venue":null,"work_id":"9de98ee9-3411-4a04-9b81-e4e9d66db726","year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.756272Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:8097b599f068d6f110e99ac5acab52f070fbf456f4cc6995f6ba239d49b01ce9","observation_id":"1927f9b5-355d-4c2f-8afa-eabfbd936fa0","resolution":{"observed_at":"2026-08-12T18:35:16.575404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.15661","last_updated":"2023-05-17T21:08:32Z","snapshot_observed_at":"2026-08-07T19:33:04.292595Z","submitted_at":"2022-11-28T18:59:51Z","title":"What learning algorithm is in-context learning? Investigations with linear models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.15661","snapshot_observed_at":"2026-08-12T18:35:15.762749Z","title":"arXiv preprint arXiv:2211.15661 (2022) Re-examining learning linear functions in context 13","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.762749Z"},"links":{"cited_paper":"/paper/2211.15661","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:da7e6b1078d83b7484ad79c244107d6e7f819ceea3ac525ff572b03ee81e4c4e","observation_id":"89a7a466-7141-483e-bce5-a15dcddd5ef0","resolution":{"observed_at":"2026-08-12T18:35:15.762749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.548415Z","title":"In: 12th Joint Conference on Lexical and Computational Semantics (*Sem)","venue":null,"work_id":"eef52f32-ca7c-4f46-b1a2-ffb4002ac7c0","year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.769109Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:b37417ea958a30e1cc2363c95baaf80ff24d89d3f30dd47f6b7eca1a7ebf616d","observation_id":"e554670a-0f7a-4566-ab32-b82f98c9cc2a","resolution":{"observed_at":"2026-08-12T18:35:16.555894Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.526047Z","title":"Advances in neural information processing systems 36 (2024)","venue":null,"work_id":"c46755c4-002d-49ca-989d-e9aff1220049","year":2024},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.775498Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:81c9218f45462f78fcf87763e4fc9103713bf85b9572e5718d5f86ac3fb12a03","observation_id":"c633eb3d-819e-45e8-a642-c93b8447955d","resolution":{"observed_at":"2026-08-12T18:35:16.532008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03016","last_updated":"2023-10-04T17:57:33Z","snapshot_observed_at":"2026-08-13T05:57:22.362244Z","submitted_at":"2023-10-04T17:57:33Z","title":"Understanding In-Context Learning in Transformers and LLMs by Learning to Learn Discrete Functions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03016","snapshot_observed_at":"2026-08-12T18:35:15.781711Z","title":"arXiv preprint arXiv:2310.03016 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.781711Z"},"links":{"cited_paper":"/paper/2310.03016","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:37b90fb16bf525dfbdce109f7554cb29b6370b83dac1d6aeead5917daafe6263","observation_id":"2f210b69-c1e9-43d8-a9c9-fee74af717e5","resolution":{"observed_at":"2026-08-12T18:35:15.781711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:15.787724Z","title":"Advances in neural information processing systems 33, 1877–1901 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.787724Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:bea878dd1954e7ca33db9f06c1b1adb57cea27a8f0c6540e24ac35211d1a7b2e","observation_id":"d49bdd5f-d8fe-4fa9-99fb-957c00702a2f","resolution":{"observed_at":"2026-08-12T18:35:15.787724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00234","last_updated":"2024-10-05T11:47:02Z","snapshot_observed_at":"2026-07-06T14:36:25.690733Z","submitted_at":"2022-12-31T15:57:09Z","title":"A Survey on In-context Learning","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.00234","snapshot_observed_at":"2026-08-12T18:35:15.795109Z","title":"arXiv preprint arXiv:2301.00234 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.795109Z"},"links":{"cited_paper":"/paper/2301.00234","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:b6b6c7d29ce9a340432334a31f1d12b31bb352937a67d382e0e0dc223aedd46b","observation_id":"c1aed684-cbd7-4a42-9ca6-fba7188ed0ae","resolution":{"observed_at":"2026-08-12T18:35:15.795109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17086","last_updated":"2024-11-16T08:20:24Z","snapshot_observed_at":"2026-08-13T05:40:14.074948Z","submitted_at":"2023-10-26T01:08:47Z","title":"Transformers Learn to Achieve Second-Order Convergence Rates for In-Context Linear Regression","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17086","snapshot_observed_at":"2026-08-12T18:35:15.801784Z","title":"arXiv preprint arXiv:2310.17086 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.801784Z"},"links":{"cited_paper":"/paper/2310.17086","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:c665f08db30084b90fcac152d1c68383204abce2a761793500eedda320cfb010","observation_id":"ba895f2d-0c95-445e-ba0f-6d3163ea9897","resolution":{"observed_at":"2026-08-12T18:35:15.801784Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.492740Z","title":"Advances in Neural Information Processing Systems 35, 30583–30598 (2022)","venue":null,"work_id":"3b96a18a-77b7-4df2-8ffc-34d3a9ad4161","year":2022},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.807598Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:513f7f0a4d1a4dfbb534d1bb6cdea7edddd4660123b8f88c4dcd1c861a23fc48","observation_id":"9bfaa2aa-5c94-4554-8672-a3b0d58ecb16","resolution":{"observed_at":"2026-08-12T18:35:16.498192Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03183","last_updated":"2024-03-05T18:20:10Z","snapshot_observed_at":"2026-08-13T04:02:48.933331Z","submitted_at":"2024-03-05T18:20:10Z","title":"How Well Can Transformers Emulate In-context Newton's Method?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03183","snapshot_observed_at":"2026-08-12T18:35:15.813064Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.813064Z"},"links":{"cited_paper":"/paper/2403.03183","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:c3bebdb371654dfa169e853ee3e4463104ce24d34cc22f93f4cdfed839521e40","observation_id":"f1c9b27e-6001-4152-9f6f-a7a8989e7263","resolution":{"observed_at":"2026-08-12T18:35:15.813064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.6980","last_updated":"2017-01-30T01:27:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2014-12-22T13:54:29Z","title":"Adam: A Method for Stochastic Optimization","version":9},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.6980","snapshot_observed_at":"2026-08-12T18:35:15.819329Z","title":"arXiv preprint arXiv:1412.6980 (2014)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.819329Z"},"links":{"cited_paper":"/paper/1412.6980","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:a1a77f595d86d101093ba728dd988c4810fe97ed50f397f3b4d2df6d534167de","observation_id":"ca97afd2-2218-437f-9deb-1eef7652e007","resolution":{"observed_at":"2026-08-12T18:35:15.819329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.473785Z","title":null,"venue":null,"work_id":"7e0dae7d-54f0-4a11-b2c6-65fd7d907796","year":2024},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.826547Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:f8c8108c597c81f76f96357d2ee9308cd3359a5d7b68bae581f6ffc51045fc87","observation_id":"6357edfa-b4e9-4d4c-b282-9e8f932f1c39","resolution":{"observed_at":"2026-08-12T18:35:16.480315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.03576","last_updated":"2023-07-07T13:09:18Z","snapshot_observed_at":"2026-08-10T21:08:50.414897Z","submitted_at":"2023-07-07T13:09:18Z","title":"One Step of Gradient Descent is Provably the Optimal In-Context Learner with One Layer of Linear Self-Attention","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.03576","snapshot_observed_at":"2026-08-12T18:35:15.834501Z","title":"arXiv preprint arXiv:2307.03576 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.834501Z"},"links":{"cited_paper":"/paper/2307.03576","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:ae43b7199be22ec6faf0d3c762f5bdc6c850431d172241009b2b66621b40b6a6","observation_id":"761a02ba-6dfa-4007-8704-a2658a6ebc45","resolution":{"observed_at":"2026-08-12T18:35:15.834501Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.05229","last_updated":"2025-08-27T16:24:39Z","snapshot_observed_at":"2026-07-06T19:29:09.714725Z","submitted_at":"2024-10-07T17:36:37Z","title":"GSM-Symbolic: Understanding the Limitations of Mathematical Reasoning in Large Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.05229","snapshot_observed_at":"2026-08-12T18:35:15.843020Z","title":"arXiv preprint arXiv:2410.05229 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.843020Z"},"links":{"cited_paper":"/paper/2410.05229","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:de7a438ac7c5fc2a8b0e4bcf3f2038e2401915e46a42e6579a489b9098eb93b6","observation_id":"7023696a-9df0-4172-af07-910a6a464616","resolution":{"observed_at":"2026-08-12T18:35:15.843020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.454154Z","title":"In: ECAI 2024, pp","venue":null,"work_id":"7a189899-9722-4782-9d9e-3c7e7ab57194","year":2024},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.850778Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:a1c5be45c5a67b4741baca04cbd009d710de6a65bef7fb7f31734ed665050528","observation_id":"0c00b18a-93f5-4c27-96f3-2dc08aaa7fc1","resolution":{"observed_at":"2026-08-12T18:35:16.459624Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.05217","last_updated":"2023-10-19T21:25:32Z","snapshot_observed_at":"2026-08-02T10:20:00.635719Z","submitted_at":"2023-01-12T18:56:49Z","title":"Progress measures for grokking via mechanistic interpretability","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.05217","snapshot_observed_at":"2026-08-12T18:35:15.858902Z","title":"arXiv preprint arXiv:2301.05217 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.858902Z"},"links":{"cited_paper":"/paper/2301.05217","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:c4a6a09bb5aaeeb9559897e5b3a38d8446f3ba7cc9492332bab331bd78f1dbb5","observation_id":"dd94b566-7205-4803-9313-fb000bee459f","resolution":{"observed_at":"2026-08-12T18:35:15.858902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.435910Z","title":"In: The 2023 Conference on Empirical Methods in Natural Language Processing (2023)","venue":null,"work_id":"d9878d53-9354-4270-9cdf-c9ef5b24b317","year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.865187Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:fa7b25a26f2324613e88a09e84dcf950a6ad0fa8dd691c1dacf09aef868b60e0","observation_id":"f0febd8d-ec39-4286-a850-30a05e89044e","resolution":{"observed_at":"2026-08-12T18:35:16.441766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-12T18:35:15.871432Z","title":"arXiv preprint arXiv:2209.11895 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.871432Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:e4dc4f2578365456a30aaf0bef07d377cc6dcad5f17dcc7dc2d4cdc487c98948","observation_id":"2d3389f1-c0df-4459-9168-6eee5e7c1877","resolution":{"observed_at":"2026-08-12T18:35:15.871432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.04891","last_updated":"2024-04-14T05:12:52Z","snapshot_observed_at":"2026-08-07T21:36:08.711693Z","submitted_at":"2023-06-08T02:38:23Z","title":"In-Context Learning through the Bayesian Prism","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.04891","snapshot_observed_at":"2026-08-12T18:35:15.877579Z","title":"arXiv preprint arXiv:2306.04891 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.877579Z"},"links":{"cited_paper":"/paper/2306.04891","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:5be2fd01de5cbe7997deed8bf6da3a41d7ba03d517b25234e9b5bd73eda2b0fd","observation_id":"5fc795d3-bdfc-4a3b-8c39-00265c2af0b5","resolution":{"observed_at":"2026-08-12T18:35:15.877579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.416452Z","title":"Journal of Machine Learning Research 22(75), 1–35 (2021)","venue":null,"work_id":"149eb4f2-137d-40f8-abe2-d731202f5245","year":2021},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.883991Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:912c5a9b37485d67fad055be3dea25f10c18fd1bd9bf1c69af6d55d326da7ac7","observation_id":"da707730-e61f-4d54-a359-f43d50110f01","resolution":{"observed_at":"2026-08-12T18:35:16.422054Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:15.889857Z","title":"OpenAI blog 1(8), 9 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.889857Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:651bf78a1c4362b9df03e83da69f5822d91430df12abf1eb6a88151d25b19a7a","observation_id":"a7364b03-2252-43b0-8fe9-636fc4c21c14","resolution":{"observed_at":"2026-08-12T18:35:15.889857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.383627Z","title":"Advances in Neural Information Processing Systems 36 (2024) 14 Omar Naim, Guilhem Fouilhé, and Nicholas Asher","venue":null,"work_id":"0dbdc86c-3ea0-4c94-841f-24fe94b5ab4e","year":2024},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.895480Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:82df2b29187e46448bde4a1ff92b24438695974e37968a8fda40147cf1614218","observation_id":"8f06e367-c44f-4687-b25a-5fe0520cf9d4","resolution":{"observed_at":"2026-08-12T18:35:16.389988Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.363305Z","title":"In: International Conference on Machine Learning","venue":null,"work_id":"e75df659-ce2b-4cf8-9d6d-a105b4418cf9","year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.900588Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:453360ec5249059a20733498fb7688c2d25f32ddd16b2faf73a2c599472693f4","observation_id":"18b02a72-f861-4ec3-9d2d-7b6a8fbb0d47","resolution":{"observed_at":"2026-08-12T18:35:16.369143Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2211.00593","last_updated":"2022-11-01T17:08:44Z","snapshot_observed_at":"2026-08-05T06:04:21.031867Z","submitted_at":"2022-11-01T17:08:44Z","title":"Interpretability in the Wild: a Circuit for Indirect Object Identification in GPT-2 small","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.00593","snapshot_observed_at":"2026-08-12T18:35:15.906557Z","title":"arXiv preprint arXiv:2211.00593 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.906557Z"},"links":{"cited_paper":"/paper/2211.00593","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:c418140d3b6495e9a87890f0e1cad3f7e7a35539c4b5c1ac1049c477d5fdcbae","observation_id":"fdb5b179-97c4-438d-899e-909320fac7a8","resolution":{"observed_at":"2026-08-12T18:35:15.906557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.08391","last_updated":"2024-03-15T02:01:17Z","snapshot_observed_at":"2026-08-13T05:50:35.011417Z","submitted_at":"2023-10-12T15:01:43Z","title":"How Many Pretraining Tasks Are Needed for In-Context Learning of Linear Regression?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.08391","snapshot_observed_at":"2026-08-12T18:35:15.912984Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.912984Z"},"links":{"cited_paper":"/paper/2310.08391","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:f5a24b01c5d72e8bffd12712be5de42bde62f6c31cebfcc2895f953498987ca8","observation_id":"c9a62a2d-6c0f-434b-8130-f83f8b3de419","resolution":{"observed_at":"2026-08-12T18:35:15.912984Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02080","last_updated":"2022-07-21T07:44:13Z","snapshot_observed_at":"2026-08-10T22:45:29.185791Z","submitted_at":"2021-11-03T09:12:33Z","title":"An Explanation of In-context Learning as Implicit Bayesian Inference","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02080","snapshot_observed_at":"2026-08-12T18:35:15.919063Z","title":"arXiv preprint arXiv:2111.02080 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.919063Z"},"links":{"cited_paper":"/paper/2111.02080","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:65aaa504dec4a585d294707476aaaa06e7f10d27dacb899deb701d814c4b9e9f","observation_id":"fe5334ed-dda0-442f-b400-c70dbeac0dde","resolution":{"observed_at":"2026-08-12T18:35:15.919063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.343015Z","title":"Journal of Machine Learning Research 25(49), 1–55 (2024)","venue":null,"work_id":"4afcd52e-3148-48d2-b9a2-22741a4ae100","year":2024},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.925535Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:4d1f0d2503fcc1eab2930692122812e7b87e7c24c15007e7067cca2dc9007c0a","observation_id":"36136142-e5e6-44d5-b387-54f26b569cd6","resolution":{"observed_at":"2026-08-12T18:35:16.349501Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.19420","last_updated":"2023-10-10T04:47:47Z","snapshot_observed_at":"2026-08-10T11:50:40.040020Z","submitted_at":"2023-05-30T21:23:47Z","title":"What and How does In-Context Learning Learn? Bayesian Model Averaging, Parameterization, and Generalization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.19420","snapshot_observed_at":"2026-08-12T18:35:15.932080Z","title":"arXiv preprint arXiv:2305.19420 (2023) A Training details Additional training information: We use the Adam optimizer [11] , and a learning rate of 10−4 for all models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.932080Z"},"links":{"cited_paper":"/paper/2305.19420","citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:63d81713f04cbd239dd4b8876970eb4352bee365993c96cb16545d6ae02749f9","observation_id":"74b37a5f-2c6d-440f-b64e-e44a8bc5c4cf","resolution":{"observed_at":"2026-08-12T18:35:15.932080Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-12T18:35:16.320584Z","title":"If we do this, the value predicted will be 0.15 for the first input, which is far from 0.4 and 0.3 instead of 0.5 for the second example","venue":null,"work_id":"55e6bc54-141f-4bb2-bda0-1b682e336070","year":null},"citing_paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context","version":4},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-12T18:35:15.937810Z"},"links":{"citing_paper":"/paper/2411.11465"},"observation_digest":"sha256:6ecd98bc0428d5faf0339c49ef2d350bf2e61eadbb2de797f8cf632206ade4f1","observation_id":"3fcbb494-30b8-4c84-b11c-6e388b94fad9","resolution":{"observed_at":"2026-08-12T18:35:16.329093Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-13T06:32:02.005865+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2411.11465","last_updated":"2025-08-31T16:55:47Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-12T18:27:32.513905Z","submitted_at":"2024-11-18T10:58:46Z","title":"Re-examining learning linear functions in context"},"reference_resolution":{"displayed":29,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":29},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-13T06:32:02.005865+00:00","source":"crossref"},{"observed_at":"2026-08-13T06:31:53.387327+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 29 of 29 outbound references and 2 inbound Pith citation observations for arXiv:2411.11465."}