{"as_of":"2026-08-09T15:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:276be6b12bc98ac2ee76fc7388a89bc646f57293e354fab592c46310c8e51aba","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":132,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":132,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":195,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T05:20:33.265098Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":1,"source":"pith","source_observed_at":"2026-08-05T02:28:24.338817Z","state":"measured"}],"external_citation_measurements":[{"count":0,"observed_at":"2026-08-05T02:28:24.338817Z","source":"pith"}],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2504.12501","last_updated":"2026-08-03T01:47:58Z","snapshot_observed_at":"2026-08-07T16:01:39.307745Z","submitted_at":"2025-04-16T21:36:46Z","title":"Reinforcement Learning from Human Feedback","version":9},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-22T19:27:40.991325Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2504.12501"},"observation_digest":"sha256:49c49fdff364718cf3f1858897a79a6bb103033c7b8c0e9538db37c3d53dff93","observation_id":"a70c6334-d3d9-4f0c-848a-e298af5bbf51","resolution":{"observed_at":"2026-05-22T19:32:01.327881Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-03T09:37:07.869083Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.13433","last_updated":"2026-05-29T00:45:48Z","snapshot_observed_at":"2026-08-03T09:37:04.326965Z","submitted_at":"2026-01-19T22:37:30Z","title":"Who Endorsed It? Measuring Authority Bias Across Expertise Levels in Language Models","version":4},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-03T09:37:07.869083Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2601.13433"},"observation_digest":"sha256:472815511bd2c3a15f98a6cb1d55182b2e96ff3088f41e742aeb0c88a243ea63","observation_id":"b2892783-8bf5-4429-920f-fad8e68a0593","resolution":{"observed_at":"2026-08-03T09:37:07.869083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2601.21257","last_updated":"2026-04-19T21:04:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-29T04:36:52Z","title":"MoCo: A One-Stop Shop for Model Collaboration Research","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T10:17:37.129753Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2601.21257"},"observation_digest":"sha256:eea34378645bb699ceac6e1fa132bfdc9937f02e95464b147d5dc9fb921a9ca3","observation_id":"f469bfab-9fdd-4a11-844c-607a29e8ae0f","resolution":{"observed_at":"2026-05-16T10:17:43.767790Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-03T07:01:23.058273Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.21601","last_updated":"2026-05-23T14:57:24Z","snapshot_observed_at":"2026-08-09T01:24:37.488748Z","submitted_at":"2026-01-29T12:08:00Z","title":"Dynamics Reveals Structure: Challenging the Linear Propagation Assumption","version":2},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-03T07:01:23.058273Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2601.21601"},"observation_digest":"sha256:b3dca5013fdd04d59b6417af1bc7c18cfd5bdecaadbfec9a714a8621e50c6cfa","observation_id":"4b8a2628-35cc-490e-ba78-d0bb8e9a73d7","resolution":{"observed_at":"2026-08-03T07:01:23.058273Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2602.01997","last_updated":"2026-08-06T07:02:58Z","snapshot_observed_at":"2026-08-09T14:09:40.026329Z","submitted_at":"2026-02-02T11:57:22Z","title":"On the Limits of Layer Pruning for Generative Reasoning in Large Language Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T08:40:24.822863Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2602.01997"},"observation_digest":"sha256:ee11ddb6e5d8c9a48c382105b7b962769c09da7e0481db9efe057913f8a41b01","observation_id":"3c8ac73d-6462-4bdc-9bc2-1630f6f29518","resolution":{"observed_at":"2026-05-16T08:40:46.192241Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2602.03839","last_updated":"2026-05-19T16:03:06Z","snapshot_observed_at":"2026-07-06T22:44:23.981940Z","submitted_at":"2026-02-03T18:56:48Z","title":"Understanding and Exploiting Weight Update Sparsity for Communication-Efficient Distributed RL","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T13:37:20.114152Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2602.03839"},"observation_digest":"sha256:cb56ed9fb41edbf4b427ad8decb9ce2371caa0e24494a6a099eaacaac1210f7d","observation_id":"3ec638c1-31fc-4793-b9ee-6cf3e7a664e2","resolution":{"observed_at":"2026-05-21T13:40:12.433127Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-03T04:54:47.405474Z","title":"Olmo 3.arXiv preprint arXiv:2512.13961, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.03846","last_updated":"2026-06-15T22:17:43Z","snapshot_observed_at":"2026-08-09T04:46:21.995253Z","submitted_at":"2026-02-03T18:59:42Z","title":"PLATE: Plasticity-Tunable Efficient Adapters for Geometry-Aware Continual Learning","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T04:54:47.405474Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2602.03846"},"observation_digest":"sha256:f2674bbcd655d11a06be4434442d0c949a4ca71b64cab9ba47cfd0032eca1c62","observation_id":"6bdfe992-5614-47db-b289-9f7f29df0c76","resolution":{"observed_at":"2026-08-03T04:54:47.405474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-03T03:22:55.174484Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.08426","last_updated":"2026-05-25T11:18:29Z","snapshot_observed_at":"2026-08-03T03:22:52.672693Z","submitted_at":"2026-02-09T09:31:06Z","title":"Prism: Spectral-Aware Block-Sparse Attention","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T03:22:55.174484Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2602.08426"},"observation_digest":"sha256:210973a206efa68fb00412f2ee33d7b7d99c3d889a4770f8f3f6131d94d638da","observation_id":"8a7b7ade-7305-4c9d-8d93-202950dbd115","resolution":{"observed_at":"2026-08-03T03:22:55.174484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2602.10995","last_updated":"2026-05-08T16:44:25Z","snapshot_observed_at":"2026-07-06T22:45:29.609382Z","submitted_at":"2026-02-11T16:20:50Z","title":"A Human-Centric Framework for Data Attribution in Large Language Models","version":2},"reference_index":142,"source":"pdf_text","source_observed_at":"2026-05-16T02:33:56.023070Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2602.10995"},"observation_digest":"sha256:53f9706bccc3f1572ae25a49b636feba7fcd7e4dbaa77c24baf8f4794d7b417f","observation_id":"d27093d5-1ab2-467e-8f42-b22e801d16e9","resolution":{"observed_at":"2026-05-16T02:37:10.591445Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-02T23:11:03.621831Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.14696","last_updated":"2026-06-18T11:23:03Z","snapshot_observed_at":"2026-08-09T03:31:36.084800Z","submitted_at":"2026-02-16T12:33:05Z","title":"A Critical Look at Targeted Instruction Selection: Disentangling What Matters (and What Doesn't)","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-02T23:11:03.621831Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2602.14696"},"observation_digest":"sha256:e42eb51ac48099a9d07d5b5d59dcdd75987917341b6bbf6b6bef7bc371382111","observation_id":"3d3c9efb-5501-4422-8778-4e2f660d5dc5","resolution":{"observed_at":"2026-08-02T23:11:03.621831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-02T22:58:14.044445Z","title":"Olmo 3.arXiv preprint arXiv:2512.13961,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2602.15327","last_updated":"2026-06-06T22:17:18Z","snapshot_observed_at":"2026-08-08T09:39:41.760302Z","submitted_at":"2026-02-17T03:13:51Z","title":"Prescriptive Scaling Reveals the Evolution of Language Model Capabilities","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-02T22:58:14.044445Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2602.15327"},"observation_digest":"sha256:f64cc3a51bae590827c7dc7836a1f20c264ef656231321d047708ebc2753ef6b","observation_id":"d9e9e5eb-a105-4625-b3f3-b3b444a7d020","resolution":{"observed_at":"2026-08-02T22:58:14.044445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-02T22:49:14.998958Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.15829","last_updated":"2026-06-08T15:32:04Z","snapshot_observed_at":"2026-08-08T10:24:00.819062Z","submitted_at":"2026-02-17T18:59:39Z","title":"Operationalising the Superficial Alignment Hypothesis via Task Complexity","version":2},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-02T22:49:14.998958Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2602.15829"},"observation_digest":"sha256:f9b542f62e76d212ffdf68c1d6e91f9a0318212930cc4e4eaa2c6a0f32447ca0","observation_id":"3c2640d1-a7be-4afe-950c-bd637c76b247","resolution":{"observed_at":"2026-08-02T22:49:14.998958Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-02T22:07:36.149973Z","title":"PPO + New KL","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2602.18037","last_updated":"2026-07-03T01:59:26Z","snapshot_observed_at":"2026-08-02T22:07:33.644090Z","submitted_at":"2026-02-20T07:32:22Z","title":"Gradient Regularization Mitigates Reward Hacking in Reinforcement Learning from Human Feedback and Verifiable Rewards","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-02T22:07:36.149973Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2602.18037"},"observation_digest":"sha256:c93c67549e78a3497068a6557bf21250d1e5b38c450a8c8079eeb244a19d86fc","observation_id":"0d53b690-99af-497c-98ce-9fcef576c7c8","resolution":{"observed_at":"2026-08-02T22:07:36.149973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-02T19:32:20.957294Z","title":"Olmoet al., “Olmo 3,”arXiv preprint arXiv:2512.13961, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.02156","last_updated":"2026-06-23T18:51:46Z","snapshot_observed_at":"2026-08-08T04:28:27.682927Z","submitted_at":"2026-03-02T18:19:49Z","title":"How Small Can 6G Reason? Scaling Tiny-to-Small Language Models for AI-Native Networks","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-02T19:32:20.957294Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2603.02156"},"observation_digest":"sha256:7b5bfee385baf0a3640df6343a510e0611e57cfa2abd11717072e8a6bc014a99","observation_id":"2a993439-84e5-4fea-830f-82b45bfe8f20","resolution":{"observed_at":"2026-08-02T19:32:20.957294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-07-15T00:06:13.080253Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.09692","last_updated":"2026-06-01T12:11:49Z","snapshot_observed_at":"2026-08-02T10:11:35.682826Z","submitted_at":"2026-03-10T13:59:50Z","title":"ActiveUltraFeedback: Efficient Preference Data Generation using Active Learning","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-15T00:06:13.080253Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2603.09692"},"observation_digest":"sha256:3f02cec5ad9f086bf691bfd0be6182e6a1dbc48c1c00e2122c500168a4e6aec4","observation_id":"3e7f9b2e-0c96-4fa3-bd84-eb6400477347","resolution":{"observed_at":"2026-07-15T00:06:13.080253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2603.09970","last_updated":"2026-05-11T14:19:12Z","snapshot_observed_at":"2026-08-08T04:45:18.756863Z","submitted_at":"2026-03-10T17:58:44Z","title":"CREATE: Testing LLMs for Associative Creativity","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-15T13:06:51.841432Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2603.09970"},"observation_digest":"sha256:2a5289170069df99c7d25f4174bb8a93a6537ecf96164b47a7a04691bd95bbc0","observation_id":"b903fe57-5712-4830-a57c-14c8d245e72e","resolution":{"observed_at":"2026-05-15T13:10:01.093472Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2603.20480","last_updated":"2026-04-30T11:40:15Z","snapshot_observed_at":"2026-08-07T14:05:15.559493Z","submitted_at":"2026-03-20T20:24:43Z","title":"Developing an ESG-Oriented Large Language Model through ESG Practices","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-15T06:51:46.136032Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2603.20480"},"observation_digest":"sha256:64c8bbc541dff14e7780663e250bc0a4b27e7bf58acf5116d845213cd4e57603","observation_id":"f42986c3-0035-4cb4-8c00-0299c4bd5231","resolution":{"observed_at":"2026-05-15T06:55:10.766626Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2603.20910","last_updated":"2026-04-04T14:02:00Z","snapshot_observed_at":"2026-08-06T13:43:37.795567Z","submitted_at":"2026-03-21T18:46:38Z","title":"LLM-ODE: Data-driven Discovery of Dynamical Systems with Large Language Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-15T06:30:29.297712Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2603.20910"},"observation_digest":"sha256:914d10bd1cfd103d3223c9c8bf08718d1229087fc4a03e5c26543b75dbed4c65","observation_id":"ea5112c9-07d8-4123-8294-2ec15599b0d0","resolution":{"observed_at":"2026-05-15T06:35:09.669219Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-02T17:26:40.224520Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.25629","last_updated":"2026-07-26T21:57:04Z","snapshot_observed_at":"2026-08-05T15:21:17.681677Z","submitted_at":"2026-03-26T16:41:59Z","title":"LanteRn: Latent Visual Structured Reasoning","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-02T17:26:40.224520Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2603.25629"},"observation_digest":"sha256:4a859b9fb8ce56b0941a8cc3ff305991485473eea1ec9b7dd4bd2d9bccca8c5f","observation_id":"c7f4292c-f835-46d4-b316-10d68ac0fde5","resolution":{"observed_at":"2026-08-02T17:26:40.224520Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.02007","last_updated":"2026-04-03T20:02:11Z","snapshot_observed_at":"2026-07-06T22:51:40.181565Z","submitted_at":"2026-04-02T13:10:27Z","title":"Apriel-1.5-OpenReasoner: RL Post-Training for General-Purpose and Efficient Reasoning","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.02007"},"observation_digest":"sha256:05a94cd3c621e9164331cab5e28cb7401857e3ad58329c43dde05874127651d9","observation_id":"5d6b3df0-e45b-405f-a589-d6c40f7ba1de","resolution":{"observed_at":"2026-05-13T21:53:19.419134Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.03480","last_updated":"2026-04-03T22:02:15Z","snapshot_observed_at":"2026-08-09T09:29:55.268371Z","submitted_at":"2026-04-03T22:02:15Z","title":"Large Language Models Align with the Human Brain during Creative Thinking","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-13T17:59:34.583755Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.03480"},"observation_digest":"sha256:fcf4e53df30a39df0e8aa6be7519641033c3d9f41f5e0da0270142a3eef1bbff","observation_id":"34551344-a679-42f4-af34-736ca4cadf75","resolution":{"observed_at":"2026-05-13T18:03:04.555386Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.04443","last_updated":"2026-04-06T05:41:02Z","snapshot_observed_at":"2026-08-09T08:53:47.973168Z","submitted_at":"2026-04-06T05:41:02Z","title":"DeonticBench: A Benchmark for Reasoning over Rules","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T20:22:03.956227Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.04443"},"observation_digest":"sha256:3c686cdc524767c9cf5bf17d182a7f5605eaab87f323f3029f7f60396b75ae4b","observation_id":"ef69b868-0466-47a4-9d08-ccef03ef656f","resolution":{"observed_at":"2026-05-10T22:00:48.068897Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.06192","last_updated":"2026-03-11T18:00:18Z","snapshot_observed_at":"2026-08-03T13:42:05.563208Z","submitted_at":"2026-03-11T18:00:18Z","title":"The Stepwise Informativeness Assumption: Why are Entropy Dynamics and Reasoning Correlated in LLMs?","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-15T13:05:26.484571Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.06192"},"observation_digest":"sha256:560ff010dada83d87a5b6a520cd6f3e8c9f73663fb3295c33de577f1232291c8","observation_id":"d5f9fac3-4894-4038-abc8-a169c7cd7478","resolution":{"observed_at":"2026-05-15T13:05:38.377509Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-07-13T08:42:28.957233Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2604.07022","last_updated":"2026-06-10T20:32:46Z","snapshot_observed_at":"2026-08-02T08:46:22.062564Z","submitted_at":"2026-04-08T12:40:09Z","title":"An Algebraic Introduction to Persistence","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T08:42:28.957233Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.07022"},"observation_digest":"sha256:44b4c590bc8a830418e286a37b50c7a94103cb1b63ae025a3c0372c059d9679b","observation_id":"b2624bc7-ba02-4402-8089-9a7139b10794","resolution":{"observed_at":"2026-07-13T08:42:28.957233Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.07023","last_updated":"2026-04-08T12:41:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-08T12:41:37Z","title":"MARS: Enabling Autoregressive Models Multi-Token Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T17:54:16.289777Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.07023"},"observation_digest":"sha256:e9d4a739ea6c4af64f11e52d2b1e62a1d5c67cdd594377df47f1b619604d6ae1","observation_id":"d5452ed4-7029-4a6b-8e8b-eb48684132ca","resolution":{"observed_at":"2026-05-11T05:55:56.284140Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.08477","last_updated":"2026-06-04T07:25:57Z","snapshot_observed_at":"2026-07-12T23:51:05.788513Z","submitted_at":"2026-04-09T17:16:07Z","title":"SUPERNOVA: Eliciting General Reasoning in LLMs with Reinforcement Learning on Natural Instructions","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T17:16:29.695213Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.08477"},"observation_digest":"sha256:c6dbeca6d77b036f9d678a96a6024d870a87b64a04a709ebbbd2e66c3a05ead3","observation_id":"d67f34ce-3acf-433c-a4a7-d27e7367e6f1","resolution":{"observed_at":"2026-05-11T07:11:01.517348Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.09852","last_updated":"2026-04-10T19:30:29Z","snapshot_observed_at":"2026-07-06T22:58:38.807460Z","submitted_at":"2026-04-10T19:30:29Z","title":"MEMENTO: Teaching LLMs to Manage Their Own Context","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-10T17:16:36.784237Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.09852"},"observation_digest":"sha256:caa1edc084b01ed84d324694cbe78748680601a06e7871a65078904f7d9bc4ba","observation_id":"2cd19a5b-2a0f-4f7c-8df6-67948961d98d","resolution":{"observed_at":"2026-05-11T07:10:59.524353Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.10733","last_updated":"2026-04-12T17:12:55Z","snapshot_observed_at":"2026-07-06T22:59:18.756089Z","submitted_at":"2026-04-12T17:12:55Z","title":"Too Nice to Tell the Truth: Quantifying Agreeableness-Driven Sycophancy in Role-Playing Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-10T16:05:09.033412Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.10733"},"observation_digest":"sha256:a0806785b08a5bd813c37fff1beb1c95c1f97e9ab4bbf43e85501f401f9e98f6","observation_id":"09c38ccc-4e4f-4ef0-9296-c6eba5a78ba6","resolution":{"observed_at":"2026-05-11T09:21:01.002540Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.10827","last_updated":"2026-04-12T21:49:13Z","snapshot_observed_at":"2026-08-05T18:01:30.449144Z","submitted_at":"2026-04-12T21:49:13Z","title":"Your Model Diversity, Not Method, Determines Reasoning Strategy","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-10T15:16:30.448400Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.10827"},"observation_digest":"sha256:0bf611852180f665d7b550bcff0d09e07a585c9030e18eae774a36e8af179c92","observation_id":"fbd68649-af1d-4817-bd9a-c90336dedf68","resolution":{"observed_at":"2026-05-11T10:56:02.819733Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.13538","last_updated":"2026-04-15T06:37:26Z","snapshot_observed_at":"2026-07-06T23:01:32.542040Z","submitted_at":"2026-04-15T06:37:26Z","title":"Synthesizing Instruction-Tuning Datasets with Contrastive Decoding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.13538"},"observation_digest":"sha256:dcb6b68d8124baba50528591c75e10b6bc5949db4858865f5c34849fa0b4ab6c","observation_id":"a290ece7-d44b-4070-be92-b6c8020b5c7a","resolution":{"observed_at":"2026-05-10T14:15:28.342586Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.14463","last_updated":"2026-04-15T22:45:59Z","snapshot_observed_at":"2026-07-06T23:02:13.885476Z","submitted_at":"2026-04-15T22:45:59Z","title":"Psychological Steering of Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-10T12:44:46.997345Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.14463"},"observation_digest":"sha256:11086a11f135a827fdb976d4394236778fc8acc9793cfb32dc7a6f66b24ea8c8","observation_id":"c2caa47a-2961-4936-b24d-b0d7a9d7c207","resolution":{"observed_at":"2026-05-10T12:45:23.892904Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.15149","last_updated":"2026-04-16T15:30:10Z","snapshot_observed_at":"2026-07-06T23:02:44.990811Z","submitted_at":"2026-04-16T15:30:10Z","title":"LLMs Gaming Verifiers: RLVR can Lead to Reward Hacking","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T11:47:43.259266Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.15149"},"observation_digest":"sha256:60d42334b3f400017888db6470cd8194fd3312715fa345980efc212ea92150e2","observation_id":"a4ab56ef-8cde-43ba-876d-af8c5c0c649f","resolution":{"observed_at":"2026-05-10T11:50:20.272253Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.15602","last_updated":"2026-04-17T00:56:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-04-17T00:56:59Z","title":"GroupDPO: Memory efficient Group-wise Direct Preference Optimization","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-10T09:43:18.432084Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.15602"},"observation_digest":"sha256:0f6b162c793edc799f175bb38c40353045907ccb90ab51bef8ae054e62128cc9","observation_id":"5df40c62-7576-4458-b042-c4e256eff5e5","resolution":{"observed_at":"2026-05-10T09:43:48.728571Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.16197","last_updated":"2026-07-19T20:58:40Z","snapshot_observed_at":"2026-08-07T01:48:38.832815Z","submitted_at":"2026-04-17T16:07:11Z","title":"Sketching the Readout of Large Language Models for Scalable Data Attribution and Valuation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-10T08:47:36.122054Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.16197"},"observation_digest":"sha256:47e7996c4cbcb9b0a296ce6aacb89519903e3e450e9f4d31aabf798b65039c8f","observation_id":"cc1e2d9f-9885-47a6-83ff-047a87fd54b0","resolution":{"observed_at":"2026-05-10T08:48:01.024098Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-02T16:12:11.410540Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2604.16197","last_updated":"2026-07-19T20:58:40Z","snapshot_observed_at":"2026-08-07T01:48:38.832815Z","submitted_at":"2026-04-17T16:07:11Z","title":"Sketching the Readout of Large Language Models for Scalable Data Attribution and Valuation","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-02T16:12:11.410540Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.16197"},"observation_digest":"sha256:27ab8e11f2f356f4dacb61ddefdd41e7cf7bd3c7f89c2464364da1de3b96d760","observation_id":"8143f803-af93-46e0-8a8f-3e7cf296ebe1","resolution":{"observed_at":"2026-08-02T16:12:11.410540Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.17761","last_updated":"2026-04-20T03:24:11Z","snapshot_observed_at":"2026-08-04T06:40:12.598546Z","submitted_at":"2026-04-20T03:24:11Z","title":"Contrastive Attribution in the Wild: An Interpretability Analysis of LLM Failures on Realistic Benchmarks","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-10T05:12:31.218055Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.17761"},"observation_digest":"sha256:b38cae48acd684654d92ccc143fe1442150ba2864febaffe89ebacccca28c0d6","observation_id":"daa04f54-cfa7-4384-bb90-de5f2f66d479","resolution":{"observed_at":"2026-05-10T09:38:42.847992Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.17930","last_updated":"2026-04-20T08:11:04Z","snapshot_observed_at":"2026-07-06T23:04:55.190916Z","submitted_at":"2026-04-20T08:11:04Z","title":"Heterogeneity in Formal Linguistic Competence of Language Models: Is Data the Real Bottleneck?","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-05-10T04:56:14.870058Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.17930"},"observation_digest":"sha256:de07c370cfd160069fca6137d11f9dd10182ac04f3b0f53ce511cdf8fac0d968","observation_id":"7edb7089-e1c7-4333-8eec-d38484f2c89c","resolution":{"observed_at":"2026-05-10T11:05:09.431140Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.18473","last_updated":"2026-04-20T16:24:41Z","snapshot_observed_at":"2026-07-06T23:05:21.974248Z","submitted_at":"2026-04-20T16:24:41Z","title":"Train Separately, Merge Together: Modular Post-Training with Mixture-of-Experts","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-10T05:52:28.822723Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.18473"},"observation_digest":"sha256:79a5ffa9f115d24195de2c3a52a15ab2e687f1a29fc064cd06059160f7eb545d","observation_id":"3293376e-0836-4662-86cb-871ddbc467f3","resolution":{"observed_at":"2026-05-10T05:56:11.323374Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.19295","last_updated":"2026-04-21T10:01:04Z","snapshot_observed_at":"2026-07-06T23:05:58.167533Z","submitted_at":"2026-04-21T10:01:04Z","title":"TEMPO: Scaling Test-time Training for Large Reasoning Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T02:40:04.086809Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.19295"},"observation_digest":"sha256:42878fb4550950f672cf75fc45245c957a58d182f8a700f17160a951ded10f67","observation_id":"33a90066-eff1-45fc-8353-da584f0cc30c","resolution":{"observed_at":"2026-05-11T12:51:07.247618Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.21254","last_updated":"2026-07-02T01:19:03Z","snapshot_observed_at":"2026-08-06T10:48:44.855597Z","submitted_at":"2026-04-23T03:46:14Z","title":"Hyperloop Transformers","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-09T23:09:35.640412Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.21254"},"observation_digest":"sha256:4df3b87de2c1ea36dcda868f9e99ecec50d0fde394cf5ab81281fc4872242141","observation_id":"e3684817-120b-43cc-8f9f-e0d589f059e6","resolution":{"observed_at":"2026-05-11T14:16:04.422787Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.21637","last_updated":"2026-07-06T17:24:47Z","snapshot_observed_at":"2026-07-12T18:37:44.672856Z","submitted_at":"2026-04-23T12:53:16Z","title":"Multilinguality at the Edge: Developing Language Models for the Global South","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-09T21:32:37.544226Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.21637"},"observation_digest":"sha256:75fda4d167d38b17788e96558c76f69ebd8e091fd1d902df03d5e12b6f34f22e","observation_id":"40bce067-52c8-4483-aace-23bbff33d6d3","resolution":{"observed_at":"2026-05-11T14:36:04.772349Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.22167","last_updated":"2026-08-04T05:14:01Z","snapshot_observed_at":"2026-08-07T23:09:24.406140Z","submitted_at":"2026-04-24T02:30:46Z","title":"Estimating Tail Risks in Language Model Output Distributions","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-08T12:26:41.797166Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.22167"},"observation_digest":"sha256:71d67aa6cc87e92b4e4d099db5078e7b6c84ad78eb8db54d78238edc272db8dd","observation_id":"1b9d4f42-d7f0-4249-9bc6-82244fb2fdea","resolution":{"observed_at":"2026-05-11T19:16:08.133996Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.22709","last_updated":"2026-04-27T06:21:25Z","snapshot_observed_at":"2026-07-06T23:09:05.682387Z","submitted_at":"2026-04-24T16:45:51Z","title":"Thinking Without Words: Efficient Latent Reasoning with Abstract Chain-of-Thought","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-08T11:52:00.969949Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.22709"},"observation_digest":"sha256:ed8aea837d8a492ea6031d4ecedd238a44f3a0d41893ff4b0e4680d2c0889f1f","observation_id":"7b96a6f0-35c8-450b-8f69-09f053db4c4a","resolution":{"observed_at":"2026-05-11T19:31:07.417109Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.25872","last_updated":"2026-04-28T17:10:15Z","snapshot_observed_at":"2026-07-06T23:11:39.318906Z","submitted_at":"2026-04-28T17:10:15Z","title":"When Errors Can Be Beneficial: A Categorization of Imperfect Rewards for Policy Gradient","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-07T16:24:43.688967Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.25872"},"observation_digest":"sha256:bac56ed096f331c6e34a6303435172c8e71ff87e3b67f7fc63a260e5a46959c9","observation_id":"a170f578-7634-4aa8-bc62-0b5865648f16","resolution":{"observed_at":"2026-05-11T23:41:19.524345Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2604.27251","last_updated":"2026-05-27T09:45:40Z","snapshot_observed_at":"2026-08-02T07:13:10.914210Z","submitted_at":"2026-04-29T22:55:40Z","title":"Compliance versus Sensibility: On the Reasoning Controllability in Large Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-07T08:57:05.520335Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2604.27251"},"observation_digest":"sha256:60b6bafabe39f9dd0ad82f65b81be3a0f596b8df1ad292eb62995fe6c4e8c230","observation_id":"d446749e-bff5-4b7f-a6f0-b8ad3256aabb","resolution":{"observed_at":"2026-05-12T09:51:28.948882Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.00817","last_updated":"2026-08-03T16:34:49Z","snapshot_observed_at":"2026-08-06T23:37:48.639557Z","submitted_at":"2026-05-01T17:55:47Z","title":"When LLMs Stop Following Steps: A Diagnostic Study of Procedural Execution in Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-09T18:51:59.402906Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.00817"},"observation_digest":"sha256:24d945d97d07f749166bc3dcb9deebad76d3968d9851c779fff3be45de49adea","observation_id":"c2039f52-a2a3-4f3c-9665-3b3c8b487793","resolution":{"observed_at":"2026-05-11T16:06:06.359593Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.00817","last_updated":"2026-08-03T16:34:49Z","snapshot_observed_at":"2026-08-06T23:37:48.639557Z","submitted_at":"2026-05-01T17:55:47Z","title":"When LLMs Stop Following Steps: A Diagnostic Study of Procedural Execution in Language Models","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-07-01T07:48:28.381924Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.00817"},"observation_digest":"sha256:4b30a2b1e5b2bcc0005c16c94c4636d8532437207a825d7af78080867352eec5","observation_id":"7921f636-94dc-47f5-9f17-d21a1b7a681e","resolution":{"observed_at":"2026-07-01T07:55:31.104606Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-04T05:20:33.265098Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2605.00817","last_updated":"2026-08-03T16:34:49Z","snapshot_observed_at":"2026-08-06T23:37:48.639557Z","submitted_at":"2026-05-01T17:55:47Z","title":"When LLMs Stop Following Steps: A Diagnostic Study of Procedural Execution in Language Models","version":4},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-04T05:20:33.265098Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.00817"},"observation_digest":"sha256:73d21959214d7b02033b0ec035e3772438db07310ad72581bbc4d31633cf3f15","observation_id":"4c79d011-44df-4bd0-ada5-7a8dad255ecd","resolution":{"observed_at":"2026-08-04T05:20:33.265098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.01158","last_updated":"2026-05-01T23:24:23Z","snapshot_observed_at":"2026-08-02T06:00:01.445636Z","submitted_at":"2026-05-01T23:24:23Z","title":"The Hidden Cost of Thinking: Energy Use and Environmental Impact of LMs Beyond Pretraining","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-09T17:57:08.844729Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.01158"},"observation_digest":"sha256:9496369787ff30c3cd99f7cb1a4d090db35cf67df4c308ca0cb3b53a8984ee1d","observation_id":"124f68e2-6013-47f9-9688-19633c2895aa","resolution":{"observed_at":"2026-05-11T16:16:11.546756Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.01640","last_updated":"2026-05-02T23:14:20Z","snapshot_observed_at":"2026-07-06T23:14:47.444386Z","submitted_at":"2026-05-02T23:14:20Z","title":"Prescriptive Scaling Laws for Data Constrained Training","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-05-09T14:12:47.037053Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.01640"},"observation_digest":"sha256:71db967c3e33b089619ddd3ada8f54d31c2d127f31762b56a7446c35b008d3bf","observation_id":"cbcfc192-abac-4b5a-924f-1963b4873390","resolution":{"observed_at":"2026-05-11T17:01:09.402508Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.02909","last_updated":"2026-04-06T15:02:52Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-04-06T15:02:52Z","title":"Delay, Plateau, or Collapse: Evaluating the Impact of Systematic Verification Error on RLVR","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-10T18:52:52.969408Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.02909"},"observation_digest":"sha256:f914dcc4192a444f736ebc0548f3c666227a5c16874efabf57de14723c528463","observation_id":"33d62132-cfd7-49b1-8b6b-a3cc2e0494b7","resolution":{"observed_at":"2026-05-10T23:45:53.027215Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.05197","last_updated":"2026-05-06T17:57:31Z","snapshot_observed_at":"2026-08-02T21:13:27.692162Z","submitted_at":"2026-05-06T17:57:31Z","title":"Implicit Representations of Grammaticality in Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T16:30:57.151992Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.05197"},"observation_digest":"sha256:ac0d2ec7f3ac8607f931ce202b4950c6ab11a54304411124529c2625d0a4cafb","observation_id":"014e0dd0-cc50-4f1a-bcc3-b20f3714b803","resolution":{"observed_at":"2026-05-11T18:11:05.504372Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.05365","last_updated":"2026-05-06T18:44:08Z","snapshot_observed_at":"2026-08-09T11:43:52.076241Z","submitted_at":"2026-05-06T18:44:08Z","title":"ZAYA1-8B Technical Report","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-08T17:36:37.182196Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.05365"},"observation_digest":"sha256:d85d3fa5a0036348c4483c62adb0da7c0e3f0c48675b46b33e0343411500f054","observation_id":"a77e0318-542f-4ed9-b754-7405f6a3f0c9","resolution":{"observed_at":"2026-05-11T17:26:05.026730Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.06327","last_updated":"2026-05-07T14:23:31Z","snapshot_observed_at":"2026-07-06T23:18:51.157048Z","submitted_at":"2026-05-07T14:23:31Z","title":"Measuring Evaluation-Context Divergence in Open-Weight LLMs: A Paired-Prompt Protocol with Pilot Evidence of Alignment-Pipeline-Specific Heterogeneity","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-08T10:23:02.697982Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.06327"},"observation_digest":"sha256:f4b57de1b80bf1cca4e400f7214c72ce302a71716908c4ceafde115768dd8a06","observation_id":"5a810535-8302-4758-b89a-d1a0e933ca1c","resolution":{"observed_at":"2026-05-08T22:04:17.906048Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.06901","last_updated":"2026-05-07T20:02:53Z","snapshot_observed_at":"2026-07-06T23:19:20.674889Z","submitted_at":"2026-05-07T20:02:53Z","title":"Reflections and New Directions for Human-Centered Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T01:25:46.378350Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.06901"},"observation_digest":"sha256:dfcb9a9077c29d5296ef790f1ee903b03fb3c720718e6b811f32824d4190741f","observation_id":"af5e7202-4fec-481d-96ec-155b498368a8","resolution":{"observed_at":"2026-05-11T01:25:51.618535Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.07307","last_updated":"2026-05-08T06:15:50Z","snapshot_observed_at":"2026-07-06T23:19:41.053744Z","submitted_at":"2026-05-08T06:15:50Z","title":"Rethinking Dense Sequential Chains: Reasoning Language Models Can Extract Answers from Sparse, Order-Shuffling Chain-of-Thoughts","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-11T02:11:19.295354Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.07307"},"observation_digest":"sha256:8e5745b3014e066996c3b9cc817a400f6cfa2b5509988a2b6e0d79a4ad721246","observation_id":"13d5a0ab-2b63-4bef-b3cb-f50d8a426f2b","resolution":{"observed_at":"2026-05-11T03:50:57.521470Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.07315","last_updated":"2026-05-08T06:23:58Z","snapshot_observed_at":"2026-08-02T14:14:02.762524Z","submitted_at":"2026-05-08T06:23:58Z","title":"LaTER: Efficient Test-Time Reasoning via Latent Exploration and Explicit Verification","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T02:03:24.270343Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.07315"},"observation_digest":"sha256:a9ac129e43d36468af8e0811affdea4840b7ed05659266269e2065fc2af3a5b6","observation_id":"229c2c56-3cec-4898-bbf5-55f94754a0d0","resolution":{"observed_at":"2026-05-11T04:00:54.851327Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.07632","last_updated":"2026-05-08T11:59:34Z","snapshot_observed_at":"2026-07-06T23:20:01.856093Z","submitted_at":"2026-05-08T11:59:34Z","title":"Post-training makes large language models less human-like","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T02:47:23.619345Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.07632"},"observation_digest":"sha256:bd930c4ef0c8bd638214169ea920b0a2169436c23578e7a97551e61b2f7d9682","observation_id":"8cedbc62-1e25-490b-bcea-2050b1caed1e","resolution":{"observed_at":"2026-05-11T03:05:55.449524Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.07865","last_updated":"2026-05-08T15:24:51Z","snapshot_observed_at":"2026-07-06T23:20:11.042952Z","submitted_at":"2026-05-08T15:24:51Z","title":"KL for a KL: On-Policy Distillation with Control Variate Baseline","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-11T03:31:07.462474Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.07865"},"observation_digest":"sha256:e2b48375781c71e8840518810d5cdd125f1e3b41caa5a87234e4ea3ed543a990","observation_id":"a6c4c88d-6ef6-45ea-8c78-4a845c9d46f5","resolution":{"observed_at":"2026-05-11T03:40:54.180872Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.08472","last_updated":"2026-05-08T20:46:35Z","snapshot_observed_at":"2026-07-06T23:20:43.010758Z","submitted_at":"2026-05-08T20:46:35Z","title":"Mid-Training with Self-Generated Data Improves Reinforcement Learning in Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-12T01:11:50.343466Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.08472"},"observation_digest":"sha256:f6a71fa1a6a9a3d562e51648d69a527fce4e4b11f70028b453c9b82ae3f47828","observation_id":"499f4c98-07c5-4171-a6a8-4fd8ecc010a3","resolution":{"observed_at":"2026-05-12T08:26:23.370856Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.10414","last_updated":"2026-05-11T11:52:06Z","snapshot_observed_at":"2026-07-06T23:22:23.287792Z","submitted_at":"2026-05-11T11:52:06Z","title":"Remember to Forget: Gated Adaptive Positional Encoding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-12T04:44:31.449357Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.10414"},"observation_digest":"sha256:e03ed7ae325c0325dafa2fc8517e238fca3e8520ab7ae036c489b3752bcb1de1","observation_id":"c33cd83a-0fe1-4475-aa8b-10cb643312ef","resolution":{"observed_at":"2026-05-12T05:56:41.226339Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.10805","last_updated":"2026-05-11T16:30:20Z","snapshot_observed_at":"2026-08-02T16:26:05.195808Z","submitted_at":"2026-05-11T16:30:20Z","title":"Reasoning Is Not Free: Robust Adaptive Cost-Efficient Routing for LLM-as-a-Judge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-12T04:19:00.238602Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.10805"},"observation_digest":"sha256:e59d4b9e8357e911dda83ea872b9c05a19abfb3d7bf7bbbf590b7e494db13b1c","observation_id":"4f31f0f0-1714-47b4-8b0f-9a59a67abf56","resolution":{"observed_at":"2026-05-12T06:26:23.845911Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.10876","last_updated":"2026-05-11T17:27:16Z","snapshot_observed_at":"2026-08-02T09:27:46.979585Z","submitted_at":"2026-05-11T17:27:16Z","title":"AssayBench: An Assay-Level Virtual Cell Benchmark for LLMs and Agents","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-05-12T04:48:54.032360Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.10876"},"observation_digest":"sha256:ed7ccac04bcc3f4251c325ee67a75faec4ae183f32417df0a3fc16ba378a4187","observation_id":"e4626a97-0df8-4b4c-ac5f-986275cc01fa","resolution":{"observed_at":"2026-05-12T05:51:28.061170Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.11388","last_updated":"2026-05-12T01:21:37Z","snapshot_observed_at":"2026-07-06T23:23:16.461539Z","submitted_at":"2026-05-12T01:21:37Z","title":"Deep Reasoning in General Purpose Agents via Structured Meta-Cognition","version":1},"reference_index":145,"source":"arxiv_source","source_observed_at":"2026-05-13T02:47:10.398564Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.11388"},"observation_digest":"sha256:5770453f5e722272fa8a27e1f2c06a7c30099687f4aa507943d6737a56980c42","observation_id":"59277716-1893-4ba7-b8ef-42da0b883a4e","resolution":{"observed_at":"2026-05-13T02:52:09.097121Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.11609","last_updated":"2026-05-12T06:40:43Z","snapshot_observed_at":"2026-07-06T23:23:26.077921Z","submitted_at":"2026-05-12T06:40:43Z","title":"Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-13T01:30:03.483296Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.11609"},"observation_digest":"sha256:3686f85cc14cf7d43f7e36dd8f67c6250eff605f1747859108e96dc9696f7788","observation_id":"85576730-8748-47aa-9a35-0e13ece77eac","resolution":{"observed_at":"2026-05-13T01:47:04.734241Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.12227","last_updated":"2026-06-16T16:53:23Z","snapshot_observed_at":"2026-07-06T23:23:59.123377Z","submitted_at":"2026-05-12T15:04:18Z","title":"A Recipe for Long-Context Reasoning in Large Language Models via On-Policy Optimization and Distillation","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-05-13T05:29:00.576006Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.12227"},"observation_digest":"sha256:f45703297e7c0c99beaf183f3b4f7e4c42ad5cf0d42817319f91367e2c53b867","observation_id":"c6938345-d0ee-44cf-93ce-cba99ef0d9b7","resolution":{"observed_at":"2026-05-13T05:32:19.396459Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.12382","last_updated":"2026-05-12T16:45:38Z","snapshot_observed_at":"2026-08-01T14:57:41.433777Z","submitted_at":"2026-05-12T16:45:38Z","title":"Pretraining Exposure Explains Popularity Judgments in Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-13T05:53:38.494498Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.12382"},"observation_digest":"sha256:c8eb92ba3e81ec4cca9c90caa5cb35f5f7acaeaed32863f19e7c018c37ef3372","observation_id":"7d89a89d-e253-4b9c-a30a-9bd0961cfdb2","resolution":{"observed_at":"2026-05-13T06:02:23.879832Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.12705","last_updated":"2026-05-12T20:08:00Z","snapshot_observed_at":"2026-08-06T21:05:32.361086Z","submitted_at":"2026-05-12T20:08:00Z","title":"Early Data Exposure Improves Robustness to Subsequent Fine-Tuning","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T20:45:27.673290Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.12705"},"observation_digest":"sha256:a4252119ca37acb5fd2ac27ca8a906dd7b83a76f33b2abe3581ab11b59b10411","observation_id":"dadca256-641f-417e-96a7-e4d480b3e61c","resolution":{"observed_at":"2026-05-14T20:47:58.572582Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.12715","last_updated":"2026-05-15T17:01:07Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T20:22:45Z","title":"Scaling Laws for Mixture Pretraining Under Data Constraints","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-14T21:44:31.429223Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.12715"},"observation_digest":"sha256:c032fb44ae0e7359dfec47222dbcecd720126f420a8a9bccad87e6b458873ab5","observation_id":"47cdc45f-8481-477a-80d7-d1eb5fcfe9d3","resolution":{"observed_at":"2026-05-14T21:48:00.967236Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.12715","last_updated":"2026-05-15T17:01:07Z","snapshot_observed_at":"2026-07-06T23:24:23.402304Z","submitted_at":"2026-05-12T20:22:45Z","title":"Scaling Laws for Mixture Pretraining Under Data Constraints","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-19T16:36:30.007014Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.12715"},"observation_digest":"sha256:43aaa3bec7fbddc09a8c5ef380d55b31a2d990586a450997484cbe521d6675c3","observation_id":"1d1384c5-9516-4edd-8b0a-0252f39198a7","resolution":{"observed_at":"2026-05-19T16:37:39.610351Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.12726","last_updated":"2026-07-09T09:24:42Z","snapshot_observed_at":"2026-08-06T13:20:37.791677Z","submitted_at":"2026-05-12T20:30:24Z","title":"Before the Last Token: Diagnosing Final-Token Safety Probe Failures","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-14T21:37:02.439454Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.12726"},"observation_digest":"sha256:805abbc1116693e21f3d406320a28df3587893998f3538f0ba8f1b15f530d32d","observation_id":"dfe3d75d-203f-46d9-bf8d-0e1058a29e1d","resolution":{"observed_at":"2026-05-14T21:38:00.104926Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.12798","last_updated":"2026-05-12T22:27:32Z","snapshot_observed_at":"2026-08-06T10:40:00.678805Z","submitted_at":"2026-05-12T22:27:32Z","title":"Emergent and Subliminal Misalignment Through the Lens of Data-Mediated Transfer","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-14T20:36:44.104197Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.12798"},"observation_digest":"sha256:f7e0148cd230a4151242231838cd88ccede9685fe07dd15cca2541051424e1a0","observation_id":"30f7fbbb-07fe-44c0-ac52-4d920d56621f","resolution":{"observed_at":"2026-05-14T20:39:26.776715Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.12888","last_updated":"2026-05-13T02:04:22Z","snapshot_observed_at":"2026-07-06T23:24:32.412966Z","submitted_at":"2026-05-13T02:04:22Z","title":"Seed Bank, Co-op, Stoop Swap: Metaphors for Governing Language Model Data for Creative Writing","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-14T19:01:31.999545Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.12888"},"observation_digest":"sha256:93750e6aeffd3eb31ce2550fd61b68ec51dbd8a0f9101558b1ffd25106f2e318","observation_id":"38251055-fe29-4c82-b721-3f1546a3f73d","resolution":{"observed_at":"2026-05-14T19:02:50.090007Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.13045","last_updated":"2026-05-13T06:04:40Z","snapshot_observed_at":"2026-08-04T03:37:49.868484Z","submitted_at":"2026-05-13T06:04:40Z","title":"Large Language Models Lack Temporal Awareness of Medical Knowledge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-14T20:18:08.160768Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.13045"},"observation_digest":"sha256:44d31af7887ffb364944d68008f0f3dcae3c645a841671abbb88c03e87afe328","observation_id":"e02dac69-61c8-4c9d-ac07-b16fd269027a","resolution":{"observed_at":"2026-05-14T20:19:27.238868Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.13329","last_updated":"2026-05-13T10:44:23Z","snapshot_observed_at":"2026-07-06T23:24:57.051440Z","submitted_at":"2026-05-13T10:44:23Z","title":"Tracing Persona Vectors Through LLM Pretraining","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-14T20:28:17.086117Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.13329"},"observation_digest":"sha256:e5ef449eada32b93de714ed1af18ddcadf6f9399dfbc7e8ef89f5d9cde65ede5","observation_id":"e3291721-418c-4bde-ab87-070778ffccad","resolution":{"observed_at":"2026-05-14T20:29:27.827520Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.14258","last_updated":"2026-05-14T01:57:47Z","snapshot_observed_at":"2026-08-06T19:23:10.884910Z","submitted_at":"2026-05-14T01:57:47Z","title":"Dynamics of the Transformer Residual Stream: Coupling Spectral Geometry to Network Topology","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-05-15T02:37:19.354739Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.14258"},"observation_digest":"sha256:f9a9ae3efc0646be20896d708da11feaa29a9f97b5db7a8197c53f6f4e704bca","observation_id":"4f6ccaef-6153-47b7-9199-95dc7043c1fb","resolution":{"observed_at":"2026-05-15T02:38:35.849725Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.15113","last_updated":"2026-05-18T19:19:17Z","snapshot_observed_at":"2026-07-06T23:26:28.006734Z","submitted_at":"2026-05-14T17:27:34Z","title":"Learning from Language Feedback via Variational Policy Distillation","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T20:34:36.764090Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.15113"},"observation_digest":"sha256:6fe954d5a0b33623393aff94337dcb19f759f6a500bc1ac6cc084ba3538dcd61","observation_id":"614d3d8d-601c-4311-86e7-9c72906e112c","resolution":{"observed_at":"2026-05-20T20:39:00.280866Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.15172","last_updated":"2026-05-14T17:56:22Z","snapshot_observed_at":"2026-08-06T20:13:00.393114Z","submitted_at":"2026-05-14T17:56:22Z","title":"MetaBackdoor: Exploiting Positional Encoding as a Backdoor Attack Surface in LLMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-15T03:04:27.417831Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.15172"},"observation_digest":"sha256:fc151f3fef7b9dad0bdf75169b8724706f9dd214cdf81224fb593712dc05d44c","observation_id":"171d7e1b-e84f-4372-8599-d0a0666a0444","resolution":{"observed_at":"2026-05-15T03:09:44.646155Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.15726","last_updated":"2026-05-15T08:22:59Z","snapshot_observed_at":"2026-08-03T21:54:10.194743Z","submitted_at":"2026-05-15T08:22:59Z","title":"Nudging Beyond the Comfort Zone: Efficient Strategy-Guided Exploration for RLVR","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-20T19:18:52.845177Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.15726"},"observation_digest":"sha256:e3767e2d33cdd3615eec9a416599821ee4294de9f71727579d83b70ffecfa216","observation_id":"1122137a-8379-4f4f-bbe7-1b0cee6c0c5b","resolution":{"observed_at":"2026-05-20T19:18:54.360626Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.16928","last_updated":"2026-06-08T02:38:05Z","snapshot_observed_at":"2026-08-02T02:41:46.596895Z","submitted_at":"2026-05-16T10:51:58Z","title":"Full Attention Strikes Back: Transferring Full Attention into Sparse within Hundred Training Steps","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-19T20:51:29.740033Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.16928"},"observation_digest":"sha256:1e067cbf83b78769078a88c0da1aec8b462e9b4da686884898669f6f9a5e9396","observation_id":"79f5f693-362d-42dd-99a2-2bcdcf245bad","resolution":{"observed_at":"2026-05-19T20:52:46.077850Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.16928","last_updated":"2026-06-08T02:38:05Z","snapshot_observed_at":"2026-08-02T02:41:46.596895Z","submitted_at":"2026-05-16T10:51:58Z","title":"Full Attention Strikes Back: Transferring Full Attention into Sparse within Hundred Training Steps","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T19:17:28.300961Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.16928"},"observation_digest":"sha256:a6782bf3222b12aa0e67da5dd0ca2071471900885a42d78f038baab3a11e7350","observation_id":"58ffb38e-8511-4005-8f06-83eaa9230c50","resolution":{"observed_at":"2026-07-01T14:55:47.411736Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.17000","last_updated":"2026-05-16T13:53:44Z","snapshot_observed_at":"2026-07-06T23:28:02.429673Z","submitted_at":"2026-05-16T13:53:44Z","title":"BoLT: A Benchmark to Democratize Black-box Optimization Research for Expensive LLM Tasks","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-19T20:48:20.856172Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.17000"},"observation_digest":"sha256:5f1cd3aa4af9e22e1176953fda739482a8020a114aec1c96baddab6ea44ee671","observation_id":"e1921940-27da-476d-a389-cc488a27f7ad","resolution":{"observed_at":"2026-05-19T20:52:46.289874Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.19377","last_updated":"2026-05-19T05:22:21Z","snapshot_observed_at":"2026-08-08T08:40:22.971141Z","submitted_at":"2026-05-19T05:22:21Z","title":"The Evaluation Game: Beyond Static LLM Benchmarking","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-20T07:56:01.638262Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.19377"},"observation_digest":"sha256:56fbe52cf4c253446c9bbbfd52a24c986f8d23cbebfebf51eeaf4ac4ca209529","observation_id":"b058b23d-51c0-4105-84bd-7d28733b4501","resolution":{"observed_at":"2026-05-20T07:58:07.294681Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.19815","last_updated":"2026-05-19T13:10:39Z","snapshot_observed_at":"2026-07-06T23:30:30.141040Z","submitted_at":"2026-05-19T13:10:39Z","title":"LP-Eval: Rubric and Dataset for Measuring the Quality of Legal Proposition Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-20T06:26:54.253291Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.19815"},"observation_digest":"sha256:72a618c2a782db2e4a7450af408e9ca9a1643297de78b337ab66cc5851eedf85","observation_id":"1e3a2e90-23b4-4ab2-8d69-4e2f7d376a39","resolution":{"observed_at":"2026-05-20T06:28:05.453753Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.20201","last_updated":"2026-05-22T07:16:53Z","snapshot_observed_at":"2026-08-07T16:44:09.688874Z","submitted_at":"2026-04-06T16:44:17Z","title":"Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-21T09:42:35.699237Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.20201"},"observation_digest":"sha256:6dfd0e9fed0c02685d4ed21aff3c8e886286207b9174467d3b36da2f4ae175d6","observation_id":"37668a0a-b2b9-4a4d-95b4-d1fd973c00d6","resolution":{"observed_at":"2026-05-21T09:44:05.715666Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.20201","last_updated":"2026-05-22T07:16:53Z","snapshot_observed_at":"2026-08-07T16:44:09.688874Z","submitted_at":"2026-04-06T16:44:17Z","title":"Long-Context Reasoning Through Proxy-Based Chain-of-Thought Tuning","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-25T07:03:35.679259Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.20201"},"observation_digest":"sha256:4a49c0f95bf03a85e75db9839ce276f1706fa258291688ccdbe6d68bc0df538e","observation_id":"4420dc74-3cb4-499e-92d1-d0f95a0b551b","resolution":{"observed_at":"2026-05-25T07:05:26.650175Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.20258","last_updated":"2026-05-18T13:57:44Z","snapshot_observed_at":"2026-08-08T21:22:17.871185Z","submitted_at":"2026-05-18T13:57:44Z","title":"It Takes Two: Complementary Self-Distillation for Contextual Integrity in LLMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-21T08:05:44.358256Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.20258"},"observation_digest":"sha256:86c2e8fc0421743664301d47fdd92d78e5560b56c577493615a1bec5fef55d1d","observation_id":"7bbeebea-6572-47e1-b08b-ff672b4cef91","resolution":{"observed_at":"2026-05-21T08:09:51.889761Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.20382","last_updated":"2026-06-19T16:43:39Z","snapshot_observed_at":"2026-07-06T23:30:58.549353Z","submitted_at":"2026-05-19T18:32:20Z","title":"Do as I Say, Not as I Do: Instruction-Induction Conflict in LLMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T07:30:27.297971Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.20382"},"observation_digest":"sha256:760e1471ed057b7767e2e1aa0baf6cc68b1414f75224ce4b0f29908e47ec33f5","observation_id":"04d2e46f-7279-4b85-971c-169a3d293edd","resolution":{"observed_at":"2026-05-21T07:34:02.840859Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.20382","last_updated":"2026-06-19T16:43:39Z","snapshot_observed_at":"2026-07-06T23:30:58.549353Z","submitted_at":"2026-05-19T18:32:20Z","title":"Do as I Say, Not as I Do: Instruction-Induction Conflict in LLMs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T18:00:29.237972Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.20382"},"observation_digest":"sha256:a13570786b57b9f7c70f246c54406f856d7ba7a42db3e9ab5da59252dd30c430","observation_id":"33f49e11-bf76-490e-b020-c18b93fc0c06","resolution":{"observed_at":"2026-06-30T18:04:58.162987Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.20613","last_updated":"2026-05-20T01:59:50Z","snapshot_observed_at":"2026-08-03T22:01:57.501216Z","submitted_at":"2026-05-20T01:59:50Z","title":"HRM-Text: Efficient Pretraining Beyond Scaling","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-21T05:41:41.397554Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.20613"},"observation_digest":"sha256:8904558b9c27dd2b7987909684c6063d82fc38ce2f1e4560af1c1cfc3827701d","observation_id":"c8de11b9-0772-4ee3-9c26-3d0a994089a0","resolution":{"observed_at":"2026-05-21T05:43:59.041980Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.21467","last_updated":"2026-05-20T17:53:09Z","snapshot_observed_at":"2026-08-02T18:02:44.990875Z","submitted_at":"2026-05-20T17:53:09Z","title":"DelTA: Discriminative Token Credit Assignment for Reinforcement Learning from Verifiable Rewards","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-05-21T05:24:46.545570Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.21467"},"observation_digest":"sha256:8a17f08a961fa1f875a384e8c0b3f54f55183b4382060e22876e20e7b0f317eb","observation_id":"29614fdf-0a7c-4e64-a4a5-8acbfb04d955","resolution":{"observed_at":"2026-05-21T05:29:40.160389Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.21468","last_updated":"2026-05-20T17:53:20Z","snapshot_observed_at":"2026-07-06T23:31:56.199912Z","submitted_at":"2026-05-20T17:53:20Z","title":"You Only Need Minimal RLVR Training: Extrapolating LLMs via Rank-1 Trajectories","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T05:19:11.738106Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.21468"},"observation_digest":"sha256:020cc043461c25c02e26a3de950d160592d0042dcc3143fe01450357328e0484","observation_id":"102f4e88-2b6f-4b7c-be28-6fa098c5dfc3","resolution":{"observed_at":"2026-05-21T05:19:39.171370Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.22263","last_updated":"2026-05-21T10:07:46Z","snapshot_observed_at":"2026-08-02T10:25:42.509450Z","submitted_at":"2026-05-21T10:07:46Z","title":"Tailoring Teaching to Aptitude: Direction-Adaptive Self-Distillation for LLM Reasoning","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-22T08:06:30.862911Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.22263"},"observation_digest":"sha256:4902990f88ba5156150e05510a6a4de81888bb51fe3cabe7e191766047557056","observation_id":"4fe9bc65-41be-456f-8135-4dcce7761acf","resolution":{"observed_at":"2026-05-22T08:11:17.655974Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.22373","last_updated":"2026-05-22T14:13:36Z","snapshot_observed_at":"2026-07-06T23:32:44.699825Z","submitted_at":"2026-05-21T12:05:22Z","title":"Boundary-targeted Membership Inference Attacks on Safety Classifiers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-22T08:06:45.896332Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.22373"},"observation_digest":"sha256:39e6f38cd920b9103e6f803eeb01cce7dd08f7dfe57fcf10087caa9515cc4ac9","observation_id":"42602000-f6f1-41c4-8099-4c699f31d27c","resolution":{"observed_at":"2026-05-22T08:11:17.535803Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.22373","last_updated":"2026-05-22T14:13:36Z","snapshot_observed_at":"2026-07-06T23:32:44.699825Z","submitted_at":"2026-05-21T12:05:22Z","title":"Boundary-targeted Membership Inference Attacks on Safety Classifiers","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-25T05:42:55.999769Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.22373"},"observation_digest":"sha256:b9c0ed2eb0686e56e2b096fa68a0519513357ffa2ad0b141c38858820d9b6d35","observation_id":"33faa9ec-c065-41d8-bba6-0dbd02c651e5","resolution":{"observed_at":"2026-05-25T05:45:24.313901Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.22939","last_updated":"2026-05-21T18:16:17Z","snapshot_observed_at":"2026-08-02T19:57:30.828038Z","submitted_at":"2026-05-21T18:16:17Z","title":"Learnability-Informed Fine-Tuning of Diffusion Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-25T05:57:49.398665Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.22939"},"observation_digest":"sha256:c700c3558fb821e33e6940042862aa5ce4136fe16c066b771829de89ce2a44ac","observation_id":"0ea568cb-fbbe-4976-87c1-93fbed1a82d3","resolution":{"observed_at":"2026-05-25T06:00:23.454241Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.24331","last_updated":"2026-05-23T01:18:55Z","snapshot_observed_at":"2026-07-06T23:34:23.087565Z","submitted_at":"2026-05-23T01:18:55Z","title":"CurveRL: Principled Distribution-Aware Context Reweighting for LLM Reasoning","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T13:54:52.129738Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.24331"},"observation_digest":"sha256:4597fe4028ab88f8c6b21004ad4b7d4085ae88e5d146924b86d87fd34b411f0d","observation_id":"d53cd484-5f66-4518-acaf-257b0254e1ca","resolution":{"observed_at":"2026-06-30T14:04:44.936983Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.24873","last_updated":"2026-05-24T05:28:39Z","snapshot_observed_at":"2026-08-03T04:59:26.120178Z","submitted_at":"2026-05-24T05:28:39Z","title":"Towards a Universal Causal Reasoner","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.24873"},"observation_digest":"sha256:8265d6e1459484b296c7b85138b5ae8edcea371367ec354acba6a84d34ee3b08","observation_id":"3b1811fe-78c2-42a5-8473-cc4ccb43c6fd","resolution":{"observed_at":"2026-06-30T12:24:38.203560Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.25052","last_updated":"2026-05-24T12:57:01Z","snapshot_observed_at":"2026-07-06T23:35:01.860096Z","submitted_at":"2026-05-24T12:57:01Z","title":"Faithfulness Metrics Don't Measure Faithfulness: A Meta-Evaluation with Ground Truth","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T11:56:53.355299Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.25052"},"observation_digest":"sha256:7ffabf7b51b5194108ca131e39815b2a730f727541d7045870c736d3b5f77b38","observation_id":"19f21a50-1f07-4574-9687-c8bb7cdec43d","resolution":{"observed_at":"2026-06-30T12:04:39.050957Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"cited_work":{"arxiv_id":"2512.13961","doi":"10.1007/s13755-026-00428-z","metadata_source":"pith","pith_arxiv_id":"2512.13961","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Olmo 3","venue":"cs.CL","work_id":"74de5f5e-0a69-4f73-862d-e5705fa9f4bb","year":2025},"citing_paper":{"arxiv_id":"2605.25831","last_updated":"2026-05-25T13:29:02Z","snapshot_observed_at":"2026-08-02T13:52:49.237762Z","submitted_at":"2026-05-25T13:29:02Z","title":"Clarify, Abstain or Answer? Strategising in Conversation with Belief-Augmented Generation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-29T21:23:34.624527Z"},"links":{"cited_paper":"/paper/2512.13961","citing_paper":"/paper/2605.25831"},"observation_digest":"sha256:eb41f523534df329bdf69c7c9dd07d27852f62128bbe22290c7080db2b8dbd8c","observation_id":"ced57fbb-f1ed-41bb-90f3-140b4b587618","resolution":{"observed_at":"2026-06-29T21:23:58.715103Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2512.13961/citation-record","integrity":"/paper/2512.13961/integrity","json":"/paper/2512.13961/citation-record.json","paper":"/paper/2512.13961"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2023.emnlp-main.844","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Aligning Large Language Models through Synthetic Feedback","venue":null,"work_id":"cc82b379-9bc8-4f79-9a1b-002f86e006e5","year":2023},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:fbe1f0e272447031a948434a1ed29e6e9d2cb4252f6be8adaf168f9ad776b8a5","observation_id":"df1614ad-ba21-41f9-823a-a8c51d7b98f2","resolution":{"observed_at":"2026-05-16T21:31:16.827741Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.3758/s13421-014-0488-9","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":null,"venue":"Memory & Cognition","work_id":"d111de29-8bce-4ef5-8076-4bd0e37fbacc","year":2022},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:cce886521ed1479c376c2c1a351f1ce7b2820991763f49bc945c99bb8e444be2","observation_id":"0787ea5b-cebf-42d8-85b4-b4c2fb24e804","resolution":{"observed_at":"2026-05-16T21:31:16.822491Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2309.00071","last_updated":"2026-02-06T19:40:50Z","snapshot_observed_at":"2026-08-01T02:15:47.181936Z","submitted_at":"2023-08-31T18:18:07Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","version":3},"cited_work":{"arxiv_id":"2309.00071","doi":"10.48550/arxiv.2309.00071","metadata_source":"pith","pith_arxiv_id":"2309.00071","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"YaRN: Efficient Context Window Extension of Large Language Models","venue":"cs.CL","work_id":"31f454a9-7de2-4696-86f2-9bfa1410f80d","year":2023},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2309.00071","citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:e1116aa8e7bf51f5e7e398035e75f30dff0ea79a18d135c899f1c486a5bf734e","observation_id":"d54cce12-cf5c-4a4e-ac8d-dd260a826fa3","resolution":{"observed_at":"2026-05-16T21:31:16.825633Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.01815","last_updated":"2017-12-05T18:45:38Z","snapshot_observed_at":"2026-08-02T00:39:04.960144Z","submitted_at":"2017-12-05T18:45:38Z","title":"Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm","version":1},"cited_work":{"arxiv_id":"1712.01815","doi":"10.48550/arxiv.1712.01815","metadata_source":"pith","pith_arxiv_id":"1712.01815","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Mastering Chess and Shogi by Self-Play with a General Reinforcement Learning Algorithm","venue":"cs.AI","work_id":"9978bd70-b9dd-4eb6-928b-66c2d40da222","year":2017},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/1712.01815","citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:9eaed973ed29c34ae7c566eef6080d7293754a5f3dc6507a193012d8671c3029","observation_id":"7410afe3-f7c1-4cd2-b1c9-81ad21f0280e","resolution":{"observed_at":"2026-05-16T21:31:16.815834Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-02T13:38:12.382503+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-02T13:38:12.382503+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04652","last_updated":"2025-01-21T10:12:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-03-07T16:52:49Z","title":"Yi: Open Foundation Models by 01.AI","version":3},"cited_work":{"arxiv_id":"2403.04652","doi":"10.48550/arxiv.2403.04652","metadata_source":"pith","pith_arxiv_id":"2403.04652","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Yi: Open Foundation Models by 01.AI","venue":"cs.CL","work_id":"8efee8a1-5e3c-4851-9c65-18e3d1d9e769","year":2024},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2403.04652","citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:539f3d2a4371186c656108f38402c04d619c513ce0bad61fbacca760beda3b8c","observation_id":"87cbf12e-c398-4775-abe2-0e13ed10e2d7","resolution":{"observed_at":"2026-05-16T21:31:16.820661Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/2024.acl-long.427","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"items in cart","venue":null,"work_id":"4d1d17e8-69e8-41ee-8cc8-8054283686cc","year":2023},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:3d9fb5d019a9a2b6b177ffb9a22df200e66275b9a9df77d49a692f2852bb0215","observation_id":"21fc74c0-8c97-40aa-a193-840ce9688f97","resolution":{"observed_at":"2026-05-16T21:31:16.817894Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Strategy Selection focuses purely on meta-cognitive choice processes, while Conversation Generation integrates all capabilities through educational dialogue","venue":null,"work_id":"92d61605-309e-4e54-a95b-92108d476adc","year":2025},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:5ae546b2f3195cdb48c6b99eaa02e5c4c54342ce8f3614be65d5fe15331dbc5f","observation_id":"3e05779f-2083-48ee-b033-4f7841b98131","resolution":{"observed_at":"2026-05-16T21:31:17.169947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"24e4550b-ba6a-4f0c-8921-a2af9a12c4c3","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:d9dd1a091fbb81813addc605e9029889dccd9a16efbae84cad12a6fd8d40895b","observation_id":"922d9f52-232b-4f47-b2fd-c4f6ae00e59b","resolution":{"observed_at":"2026-05-16T21:31:17.176308Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"(2025b), contains thinking traces covering domains of math, astronomy, biology, chemistry, computer science, geography, physics, English, law, logic, and more","venue":null,"work_id":"699c7014-0877-4200-a315-8977636ed608","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:8362319f51f661b8d364415a52d9bfb4e2210bafabd9cc06c1d691f32b45e5de","observation_id":"7c7c7728-515b-45d6-a547-fa49103cc636","resolution":{"observed_at":"2026-05-16T21:31:17.197139Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"(2025b) contains thinking traces in domains of math, science, code, and puzzles","venue":null,"work_id":"3d28779d-f566-42f3-ac08-2b3ffb9df47f","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:b24eb20802d1a0f7751dbb07af038ff9ba9136dbfc4abf242f7004a8fe76167a","observation_id":"b1a6d268-7a5d-4106-8e21-4a6166107481","resolution":{"observed_at":"2026-05-16T21:31:17.183325Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"20080531-765c-4f06-8c97-38507e6f2bc9","year":2025},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:9f54c157124e219ec5fcbe3ae0fa04ba9a3055c3e1cc0ff81259e1eeaac0aa01","observation_id":"1a62226e-b2e3-4c19-8bce-e08a584f5121","resolution":{"observed_at":"2026-05-16T21:31:17.191709Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ed57c840-3ffd-4a81-939c-35ae15d1f866","year":2025},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:4db03550ebbf6ffdddc72896ac6be14416d38e3983f4042d63dd17bee81255b2","observation_id":"ab777943-338a-4685-a356-2e94a91960a8","resolution":{"observed_at":"2026-05-16T21:31:17.181178Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"The key idea is that we ‘warm up’ to the format of the target set without learning a lot of new knowledge","venue":null,"work_id":"07ebef80-d7e3-4afc-9437-1de7c9fc9625","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:a9103a905ed74d493cf85b6b9eedfd931dc1867ed269cedacccce23609630717","observation_id":"09d682a4-23ea-4503-800c-89fe7cc3d8fa","resolution":{"observed_at":"2026-05-16T21:31:17.194300Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9c179d06-12e9-4874-b2a7-3ac725966ccf","year":2022},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:7bb66b320275f2dbb1bb7c70b401fa59fdbe49b48ca86d6190c91dd81284194e","observation_id":"f40fcacb-145d-44ac-b412-c690628ffeea","resolution":{"observed_at":"2026-05-16T21:31:17.155199Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"question","venue":null,"work_id":"28c758f9-6ce9-4637-a691-54462125d54a","year":2023},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:6759dd5fd7970b01edf30af9799779d4adc9f5bae7cee54c37fc2bab494b6f4b","observation_id":"95b9b64b-a1bb-4d3f-9ec6-b0d26dd659b7","resolution":{"observed_at":"2026-05-16T21:31:17.161626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"\" question","venue":null,"work_id":"ab405687-9796-4a21-a47a-baab441f978d","year":2024},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:87fcd1b100b4f7ee539d82aeba36015b5ac65a1101c5445039dba4581c69c675","observation_id":"48534825-e7fe-4acc-8491-2fc9cd86bcb3","resolution":{"observed_at":"2026-05-16T21:31:17.148725Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Olmo 3 RL-Zero achieves reasonable performance faster and is also much more compute efficient, making it better for experimentation","venue":null,"work_id":"52a1ed2c-5b11-4a31-8a44-2ffe014474ab","year":2025},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:de630aedfeec9ac45e4ac477344dfd4223c6a315efd300bf1c0fe542452f899a","observation_id":"f69af18a-2428-450c-8835-5242dd4e145b","resolution":{"observed_at":"2026-05-16T21:31:17.150902Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"43147199-f972-40fe-975e-386dce4cb8d5","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:bee88dcd44847849a74489e545013752655fecbe530ce4329b02c81fd2c52db9","observation_id":"37942a11-ae0c-4e60-b1b5-617eee00c2b9","resolution":{"observed_at":"2026-05-16T21:31:17.173179Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"if they have <think> and no </think>) and empty outputs (empty responses)","venue":null,"work_id":"3926f7a1-4230-454e-96e6-d612bb091b98","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:6866be87d6715c0499d46f700edb06b593b5b6ca69363cbee3eabdfdda625b4f","observation_id":"47f97c11-b595-4a0b-b509-27e813af0e09","resolution":{"observed_at":"2026-05-16T21:31:17.179162Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Additionally, for chat domains we use included metadata in some datasets such as Wildchat to remove responses or prompts tagged as unsafe","venue":null,"work_id":"4739bdf7-7d9d-4e61-8c05-15d254f31614","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:c73a3650f745ecf0acd9c797f4c3a7001001249360fcb949320c69b840f08d3a","observation_id":"c05cdc11-2454-49fe-96b0-d2038fea4b34","resolution":{"observed_at":"2026-05-16T21:31:17.167491Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"REASONING","venue":null,"work_id":"11e583d7-f540-40cb-a4e9-ad9ecd596e37","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:7fbfc07aa116e0cedd557e31624362586e2dd42df9a6ab6da42b0524bea63018","observation_id":"fbe691aa-b40a-4bf7-b7ea-c0e4fdc9ff85","resolution":{"observed_at":"2026-05-16T21:31:17.175169Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"In particular, we find that .1% of responses from QwQ have mass repetition","venue":null,"work_id":"8453b697-b9c8-4f5d-b3f2-bd6792a234eb","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:1dcef70dc4050da829bbaea404f180ca1228579b90c7309cf66a88f13a2bccea","observation_id":"fd5795cb-08ee-43d2-8a51-ace15e7c993c","resolution":{"observed_at":"2026-05-16T21:31:17.172344Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"user\", \"assistant","venue":null,"work_id":"8bd72a05-1488-4eb8-9f2a-7991508b4e88","year":2025},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:9e1bbfcfecc09c4dbcf47ac597b80ec0fd3a222801b5f91358b21481b14c2e69","observation_id":"d237ab34-17aa-41fe-8abb-1d5210451f16","resolution":{"observed_at":"2026-05-16T21:31:17.174199Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4df1195d-4877-4dec-8e9b-11f5261d62db","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:8c6344fc589b4dbddf106d8029fc939d175ddb784c8a84d07d607fee311e1e76","observation_id":"fbe3068a-ba70-4a9d-8f2b-d64922d2c832","resolution":{"observed_at":"2026-05-16T21:31:17.178090Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"If it’s about math, then the request should also be about math","venue":null,"work_id":"22d6b876-a404-4986-9dfc-b28d8b998459","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:d25b34cd3903054bd75bf5955f04a232d3438ddafdbf544bcdd6f467f264cf8e","observation_id":"0fd1f800-774b-426e-a8f7-cd86e543fcba","resolution":{"observed_at":"2026-05-16T21:31:17.177225Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f1647c12-66fd-4342-abb6-0f63e99d1ff9","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:adc5e5d8a0341f03c2a950b7503b0a0c0a3c5238f457b728d8a20d20930ab798","observation_id":"4a085ace-a912-4382-966f-7211bb27c126","resolution":{"observed_at":"2026-05-16T21:31:17.187557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"955cbe09-c995-47a2-8cfd-a32c449677df","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:604d75c55f629ffa6eb4cf9a67fb4f05711f744c1eee21eff39c129fc51a0858","observation_id":"5be74d9d-c496-4352-9ad1-dee2fa8bfef6","resolution":{"observed_at":"2026-05-16T21:31:17.168524Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2b219209-7af8-42cc-a12c-e32f88aa38e3","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:7ef2cd387a1c1ee83e1df7898778ad32f82c83a486a943794d96a60b02fb721d","observation_id":"4eac1037-ef9b-487f-9c57-2c6c9bd00acd","resolution":{"observed_at":"2026-05-16T21:31:17.146757Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7f9dc7bf-7630-47f7-9736-ef575c820ac6","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:a84a48e36b9d1203a04957c7fa580937a0b66210dfa1c1ebe3c507fa673e8687","observation_id":"4ac285c0-4269-4c2a-bea4-1d7cad11b217","resolution":{"observed_at":"2026-05-16T21:31:17.157372Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8ab2e58f-1c65-4c7a-92aa-7c2e7895c573","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:fe8c38ff4fc61e334b8d84ca472cdc56bbe2cd4f0ade1c225c5ab259ac7da06a","observation_id":"209c2f9b-e9f1-4c29-8945-eda7b2489743","resolution":{"observed_at":"2026-05-16T21:31:17.159626Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ca796677-29a3-4dd5-9473-23d3fef428c1","year":null},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:2395821e250711fc20e6e376d8f91fd0b2f87f1051da28f34688ef2a37ba7cf1","observation_id":"8340fc7e-3e67-4141-a390-72a6e56381fb","resolution":{"observed_at":"2026-05-16T21:31:17.189692Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Compute the perimeter of a rectangle with length 10 and width 5","venue":null,"work_id":"e643c3a9-73c2-414f-8758-8cae6f52e53e","year":2024},"citing_paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-16T21:30:35.640946Z"},"links":{"citing_paper":"/paper/2512.13961"},"observation_digest":"sha256:bf0f2dc1bbfda32e64d7ceabafdd242b159ab54fd45adefe79b3ee469bf75d97","observation_id":"f8ab1842-760c-48d8-a576-ee2bc3afe4d1","resolution":{"observed_at":"2026-05-16T21:31:17.185615Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2512.13961","last_updated":"2026-04-14T15:12:44Z","latest_version":2,"primary_category":"cs.CL","snapshot_observed_at":"2026-08-07T08:18:31.274999Z","submitted_at":"2025-12-15T23:41:48Z","title":"Olmo 3"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":2,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":11,"verified_exact":3,"verified_fuzzy":13},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 100 inbound Pith citation observations for arXiv:2512.13961."}