{"as_of":"2026-08-07T20:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a8efcb63782169475f42d878a266d4812f28f2c3937d06533c52e2f8ce588f5c","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:41:41.745767Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-01T22:06:16.575794Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-07T14:41:41.745767Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.17988","last_updated":"2025-08-05T11:46:13Z","snapshot_observed_at":"2026-08-07T14:34:50.601012Z","submitted_at":"2025-05-23T14:55:22Z","title":"Towards Revealing the Effectiveness of Small-Scale Fine-tuning in R1-style Reinforcement Learning","version":3},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-07T14:41:41.745767Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2505.17988"},"observation_digest":"sha256:4192f0d201ab9a1f9623278e354f6a3df708323c4b69cad0e29fecbac0b8ed0a","observation_id":"cd2a7a68-530a-49df-9b75-a23b2a061db7","resolution":{"observed_at":"2026-08-07T14:41:41.745767Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-07T14:29:32.572317Z","title":"Learning dynamics of llm finetuning.arXiv preprint arXiv:2407.10490, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.18830","last_updated":"2025-05-24T18:58:51Z","snapshot_observed_at":"2026-08-07T14:22:40.658601Z","submitted_at":"2025-05-24T18:58:51Z","title":"On the Effect of Negative Gradient in Group Relative Deep Reinforcement Optimization","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:29:32.572317Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2505.18830"},"observation_digest":"sha256:f09ace80d43da3ef59fb57483e5dfb371e2eca739054a5e65bc8cd6a2c8026de","observation_id":"cb0aa861-d8ce-4d6a-9d29-a536550589d8","resolution":{"observed_at":"2026-08-07T14:29:32.572317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-07T00:54:49.770445Z","title":"Sutherland","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.00018","last_updated":"2025-07-04T08:16:16Z","snapshot_observed_at":"2026-08-07T00:41:17.848176Z","submitted_at":"2025-06-15T05:42:29Z","title":"Implicit Reward as the Bridge: A Unified View of SFT and DPO Connections","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:54:49.770445Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2507.00018"},"observation_digest":"sha256:857e8d9433906c745f952745553c93c8fbaf036b3098336e35c64873a5e221e4","observation_id":"1990d6db-a32b-4898-9e51-03d125c24718","resolution":{"observed_at":"2026-08-07T00:54:49.770445Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-05T17:21:25.280778Z","title":"True R :","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2508.16546","last_updated":"2025-08-22T17:10:37Z","snapshot_observed_at":"2026-08-06T19:53:30.514356Z","submitted_at":"2025-08-22T17:10:37Z","title":"RL Is Neither a Panacea Nor a Mirage: Understanding Supervised vs. Reinforcement Learning Fine-Tuning for LLMs","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T17:21:25.280778Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2508.16546"},"observation_digest":"sha256:b95746b5050eea565b45d176867b2c0d6007a8d525c09b367260eed6fc5fed88","observation_id":"bf3bf01c-0ebf-45bb-ae2d-bdd292bf06fc","resolution":{"observed_at":"2026-08-05T17:21:25.280778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-04T12:12:57.561553Z","title":"Sutherland","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.03595","last_updated":"2026-07-10T05:48:25Z","snapshot_observed_at":"2026-08-06T13:46:23.950295Z","submitted_at":"2025-10-04T00:52:48Z","title":"Decoupling Task-Solving and Output Formatting in LLM Generation","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-04T12:12:57.561553Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2510.03595"},"observation_digest":"sha256:491e76bd6bf30f124c087fd831ceecf51c0d41eb6e56fca8639356020caac40c","observation_id":"5a6839e6-4658-44d7-a60d-2cff956cb3ee","resolution":{"observed_at":"2026-08-04T12:12:57.561553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2512.00778","last_updated":"2026-05-15T09:26:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-30T08:27:59Z","title":"What Is Preference Optimization Doing, and Why?","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T18:37:48.161545Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2512.00778"},"observation_digest":"sha256:0f44e67c217e4c57c5b1d269de903994f295f707c0243b4507a59a1747920e61","observation_id":"d78c3bd0-1096-4aa4-a769-25da7a428295","resolution":{"observed_at":"2026-05-21T18:40:28.947037Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2602.23964","last_updated":"2026-04-28T09:24:17Z","snapshot_observed_at":"2026-08-07T15:28:21.148415Z","submitted_at":"2026-02-27T12:17:06Z","title":"RAD-DPO: Robust Adaptive Denoising Direct Preference Optimization for Generative Retrieval in E-commerce","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-15T19:05:00.826786Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2602.23964"},"observation_digest":"sha256:89ffc16ba294784a11990ebbd7ab094027c9f83e3bbb89ac84e39825532bc516","observation_id":"a9d916c5-57f6-4e1b-b752-dce11ca7e33d","resolution":{"observed_at":"2026-05-15T19:06:30.680839Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-14T21:37:04.895721Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2603.13910","last_updated":"2026-06-26T10:54:34Z","snapshot_observed_at":"2026-08-01T20:02:08.769626Z","submitted_at":"2026-03-14T11:46:27Z","title":"Scene Generation at Absolute Scale: Utilizing Semantic and Geometric Guidance From Text for Accurate and Interpretable 3D Indoor Scene Generation","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T21:37:04.895721Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2603.13910"},"observation_digest":"sha256:0cda67b83a5c2611195d2b7c4598ade1213b69b4fa7ef1164c58f7cf2a77be40","observation_id":"2e158d72-527a-4118-b4f8-b930dae0cf75","resolution":{"observed_at":"2026-07-14T21:37:04.895721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2604.16995","last_updated":"2026-04-18T13:49:47Z","snapshot_observed_at":"2026-07-06T23:04:10.324443Z","submitted_at":"2026-04-18T13:49:47Z","title":"SPS: Steering Probability Squeezing for Better Exploration in Reinforcement Learning for Large Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-10T06:57:03.100519Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2604.16995"},"observation_digest":"sha256:6747d97f4be43490aea1323266aa4aee9fe601b90177b1accf3404814a2ef654","observation_id":"fc835128-3a56-42a2-86bb-8a2e16499593","resolution":{"observed_at":"2026-05-10T07:01:49.448711Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2605.02626","last_updated":"2026-05-04T14:15:24Z","snapshot_observed_at":"2026-07-30T07:44:04.614445Z","submitted_at":"2026-05-04T14:15:24Z","title":"Gradient-Gated DPO: Stabilizing Preference Optimization in Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-08T18:35:13.659698Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2605.02626"},"observation_digest":"sha256:d2d7eb97917141bbbe0c1f86a8de740e2581edd9b5adf9cc41a7eff40118d7d3","observation_id":"9f7172db-7504-4c33-a776-885f13b0e1b7","resolution":{"observed_at":"2026-05-09T06:20:41.735163Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2605.07353","last_updated":"2026-05-08T07:08:25Z","snapshot_observed_at":"2026-07-06T23:19:46.018236Z","submitted_at":"2026-05-08T07:08:25Z","title":"Confidence-Aware Alignment Makes Reasoning LLMs More Reliable","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T02:10:40.020460Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2605.07353"},"observation_digest":"sha256:753636f58701c7d16c46e97b689c6cbd1b1d575c7fce9b836fc48b9c20369644","observation_id":"66c2ec75-2ba5-422c-b88f-6e502a0d3042","resolution":{"observed_at":"2026-05-11T03:50:58.188744Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2605.08378","last_updated":"2026-05-08T18:36:25Z","snapshot_observed_at":"2026-08-02T18:04:56.183678Z","submitted_at":"2026-05-08T18:36:25Z","title":"Reinforcement Learning for Scalable and Trustworthy Intelligent Systems","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-12T01:47:40.772146Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2605.08378"},"observation_digest":"sha256:42bc2f4f55531b42b40ad30c160167855ead84e9a9be8884eda0840a211900ee","observation_id":"665c7c56-9e73-4710-84ed-43ddd4ecf1cb","resolution":{"observed_at":"2026-05-12T07:51:38.989430Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2605.08666","last_updated":"2026-05-09T04:07:20Z","snapshot_observed_at":"2026-08-02T05:46:41.345933Z","submitted_at":"2026-05-09T04:07:20Z","title":"The Cancellation Hypothesis in Critic-Free RL: From Outcome Rewards to Token Credits","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-12T01:24:03.186413Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2605.08666"},"observation_digest":"sha256:2bbcb3ce43a98b0f172f0f1dd7e3d896953682fb3beb7b90eccf42a8e4f559c2","observation_id":"c72d8732-7680-4b17-a552-4319e9f2cd63","resolution":{"observed_at":"2026-05-12T08:01:29.036187Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":"2407.10490","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-01T22:06:16.575794Z","title":"Learning dynamics of llm finetuning","venue":null,"work_id":"24759bc0-951c-4496-b75e-b6165ae8f967","year":2024},"citing_paper":{"arxiv_id":"2606.01558","last_updated":"2026-06-01T02:02:23Z","snapshot_observed_at":"2026-08-04T16:32:29.186022Z","submitted_at":"2026-06-01T02:02:23Z","title":"Attention-guided Fine-tuning of Multimodal Large Language Models Improves Chain-of-Thought Reasoning","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-06-28T15:45:26.891621Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2606.01558"},"observation_digest":"sha256:2256adf1a932ea4fe7e2dae0961e99ba1a3fd0f5512d98fb007259134c518425","observation_id":"98f421c5-036b-410b-960f-f19f950996bc","resolution":{"observed_at":"2026-07-01T22:06:16.577368Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-07-13T00:42:24.432562Z","title":"arXiv preprint arXiv:2407.10490 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.09053","last_updated":"2026-07-10T02:50:21Z","snapshot_observed_at":"2026-08-06T01:57:21.331702Z","submitted_at":"2026-07-10T02:50:21Z","title":"An Emergent Mirage: Is Emergent Misalignment and Realignment Indeed a Robust Phenomenon?","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-07-13T00:42:24.432562Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2607.09053"},"observation_digest":"sha256:e6781a781355279f211206a3d32acd373e7bae68f7f37bb01fb2d001c8423a94","observation_id":"f47741bd-d9bb-435e-b246-cee0ddd3d33c","resolution":{"observed_at":"2026-07-13T00:42:24.432562Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-02T02:24:42.877960Z","title":"arXiv preprint arXiv:2407.10490 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.14371","last_updated":"2026-07-15T21:17:42Z","snapshot_observed_at":"2026-08-07T13:04:16.701334Z","submitted_at":"2026-07-15T21:17:42Z","title":"Supervised Fine-Tuning vs. In-Context Learning: An Equilibrium Analysis of LLM Personalization under Congestion","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-02T02:24:42.877960Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2607.14371"},"observation_digest":"sha256:2d437248db09eea6b1f8ac3d5c48c38eaae26352289194ac0308aa52045d8fa1","observation_id":"bf00b194-6eb2-423c-b23f-bb76c5b8a4bf","resolution":{"observed_at":"2026-08-02T02:24:42.877960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.10490","snapshot_observed_at":"2026-08-01T06:05:53.145003Z","title":"arXiv preprint arXiv:2407.10490 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.22039","last_updated":"2026-07-24T07:08:57Z","snapshot_observed_at":"2026-08-06T10:51:59.521588Z","submitted_at":"2026-07-24T07:08:57Z","title":"Enough is as good as a feast: A Comprehensive Analysis of How Reinforcement Learning Mitigates Task Conflicts in LLMs","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T06:05:53.145003Z"},"links":{"cited_paper":"/paper/2407.10490","citing_paper":"/paper/2607.22039"},"observation_digest":"sha256:d86d2e89eb46a29051b59a00bce6e5ea3762376a8fa874eeb52f3e10df332ffe","observation_id":"8d174774-00f0-4a18-81b0-4d95a0f5b50f","resolution":{"observed_at":"2026-08-01T06:05:53.145003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.10490/citation-record","integrity":"/paper/2407.10490/integrity","json":"/paper/2407.10490/citation-record.json","paper":"/paper/2407.10490"},"outbound":[],"paper":{"arxiv_id":"2407.10490","last_updated":"2025-06-29T05:43:22Z","latest_version":4,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-01T14:47:14.023229Z","submitted_at":"2024-07-15T07:30:28Z","title":"Learning Dynamics of LLM Finetuning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2407.10490."}