{"as_of":"2026-08-07T01:04:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7168b959be0cee6c5342f3deb4cfae43d08cc88d010cb5c4901f0128b9eec3ee","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":13,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":13,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":13,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":13,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T10:39:29.735455Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T16:29:57.036901Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-08-04T10:39:29.735455Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2510.09388","last_updated":"2026-06-22T08:02:17Z","snapshot_observed_at":"2026-08-04T10:39:20.309514Z","submitted_at":"2025-10-10T13:42:03Z","title":"Don't Tell the Answer, Truly Guide the Reasoning During RL Rollouts","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-04T10:39:29.735455Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2510.09388"},"observation_digest":"sha256:2da7c425797f729e35d1540823990e6ced5cd2caf0f6d2e89ec962a56b1b4764","observation_id":"ce6002ff-3b9b-4330-81cc-1e7f8f8433b4","resolution":{"observed_at":"2026-08-04T10:39:29.735455Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":"2506.17211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-07-04T16:29:57.036901Z","title":"Ceva’s theorem","venue":null,"work_id":"cb32cd66-e7f9-4795-bb6b-7dad403f73da","year":2025},"citing_paper":{"arxiv_id":"2512.18857","last_updated":"2026-05-07T11:50:40Z","snapshot_observed_at":"2026-07-06T22:39:43.359149Z","submitted_at":"2025-12-21T19:01:35Z","title":"CORE: Concept-Oriented Reinforcement for Bridging the Definition-Application Gap in Mathematical Reasoning","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-16T20:25:35.573805Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2512.18857"},"observation_digest":"sha256:6001e5dc74a8c8eba26c3a0dd0d4da54cb2989572648cfa235ab34f611c9fdcb","observation_id":"5f7d246d-fdc6-4496-bda4-305a41ec8b45","resolution":{"observed_at":"2026-05-16T20:28:24.110253Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":"2506.17211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-07-04T16:29:57.036901Z","title":"Ceva’s theorem","venue":null,"work_id":"cb32cd66-e7f9-4795-bb6b-7dad403f73da","year":2025},"citing_paper":{"arxiv_id":"2601.14249","last_updated":"2026-05-25T10:44:31Z","snapshot_observed_at":"2026-08-03T09:22:41.086646Z","submitted_at":"2026-01-20T18:58:10Z","title":"Which Reasoning Trajectories Teach Students to Reason Better? A Simple Metric of Informative Alignment","version":4},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-16T12:23:56.318846Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2601.14249"},"observation_digest":"sha256:45327e32f58da4fadfb74c97c8b877d8c79ad32e43102ae72c4f54895bffd2bb","observation_id":"1f90e798-f156-4265-bbf2-6bb762263edc","resolution":{"observed_at":"2026-05-16T12:27:52.342148Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-08-03T09:22:48.248328Z","title":"BREAD: branched rollouts from expert anchors bridge SFT & RL for reasoning.CoRR, abs/2506.17211, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2601.14249","last_updated":"2026-05-25T10:44:31Z","snapshot_observed_at":"2026-08-03T09:22:41.086646Z","submitted_at":"2026-01-20T18:58:10Z","title":"Which Reasoning Trajectories Teach Students to Reason Better? A Simple Metric of Informative Alignment","version":5},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T09:22:48.248328Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2601.14249"},"observation_digest":"sha256:c90606b45db6a64cc1d44b7d404970b6936c046cfc43dc702a6861eb588aef76","observation_id":"cfa911e6-f72e-4014-9b58-18e0a0cdc9d4","resolution":{"observed_at":"2026-08-03T09:22:48.248328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":"2506.17211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-07-04T16:29:57.036901Z","title":"Ceva’s theorem","venue":null,"work_id":"cb32cd66-e7f9-4795-bb6b-7dad403f73da","year":2025},"citing_paper":{"arxiv_id":"2601.20829","last_updated":"2026-05-09T10:47:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-01-28T18:29:21Z","title":"Training Reasoning Models on Saturated Problems via Failure-Prefix Conditioning","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-16T10:26:45.961575Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2601.20829"},"observation_digest":"sha256:0dc8df9c74f378c9c9c608a66e32c31c21649f2a194f17b27a1314634037a3a5","observation_id":"ac947f1f-e450-4296-bbf3-914c59795de6","resolution":{"observed_at":"2026-05-16T10:27:44.472349Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":"2506.17211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-07-04T16:29:57.036901Z","title":"Ceva’s theorem","venue":null,"work_id":"cb32cd66-e7f9-4795-bb6b-7dad403f73da","year":2025},"citing_paper":{"arxiv_id":"2605.02913","last_updated":"2026-04-08T00:53:29Z","snapshot_observed_at":"2026-07-06T23:15:55.848885Z","submitted_at":"2026-04-08T00:53:29Z","title":"Generate, Filter, Control, Replay: A Comprehensive Survey of Rollout Strategies for LLM Reinforcement Learning","version":1},"reference_index":176,"source":"arxiv_source","source_observed_at":"2026-05-10T19:15:27.406778Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2605.02913"},"observation_digest":"sha256:ed53d6ee992d16061f29c3a9dbf11e8ccded40177ec87dafe39f338016d931a0","observation_id":"4868544b-4871-43fe-87d0-83e5fc4872bf","resolution":{"observed_at":"2026-05-10T23:15:49.398090Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":"2506.17211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-07-04T16:29:57.036901Z","title":"Ceva’s theorem","venue":null,"work_id":"cb32cd66-e7f9-4795-bb6b-7dad403f73da","year":2025},"citing_paper":{"arxiv_id":"2605.15224","last_updated":"2026-05-13T08:50:05Z","snapshot_observed_at":"2026-08-02T16:16:00.555280Z","submitted_at":"2026-05-13T08:50:05Z","title":"ICRL: Learning to Internalize Self-Critique with Reinforcement Learning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-19T17:58:05.817581Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2605.15224"},"observation_digest":"sha256:15c378afad9ffaf80a8286c84fda38b49532e8d2f6a7fa17464cbcea2cb943cf","observation_id":"c3895e82-69c5-49c9-b926-1d6b03232eeb","resolution":{"observed_at":"2026-05-19T18:02:42.454864Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":"2506.17211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-07-04T16:29:57.036901Z","title":"Ceva’s theorem","venue":null,"work_id":"cb32cd66-e7f9-4795-bb6b-7dad403f73da","year":2025},"citing_paper":{"arxiv_id":"2605.15726","last_updated":"2026-05-15T08:22:59Z","snapshot_observed_at":"2026-08-03T21:54:10.194743Z","submitted_at":"2026-05-15T08:22:59Z","title":"Nudging Beyond the Comfort Zone: Efficient Strategy-Guided Exploration for RLVR","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-20T19:18:52.845177Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2605.15726"},"observation_digest":"sha256:ea348db7fba356adaa083bd0fcf0d30e8c83021d0aec827a17203d68f2e4920b","observation_id":"75445301-2356-42f7-b965-df56af58a95b","resolution":{"observed_at":"2026-05-20T19:18:54.388644Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":"2506.17211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-07-04T16:29:57.036901Z","title":"Ceva’s theorem","venue":null,"work_id":"cb32cd66-e7f9-4795-bb6b-7dad403f73da","year":2025},"citing_paper":{"arxiv_id":"2606.18216","last_updated":"2026-06-16T17:46:02Z","snapshot_observed_at":"2026-07-06T23:53:40.698123Z","submitted_at":"2026-06-16T17:46:02Z","title":"Zone of Proximal Policy Optimization: Teacher in Prompts, Not Gradients","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-27T01:08:52.981296Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2606.18216"},"observation_digest":"sha256:87423dbd9f61d0b215ceed2606d2537defacc9d8f9a8253bf4e0efdbbe91dec4","observation_id":"6a6d3607-e3c6-4c8e-bcca-e0ce1ebe180d","resolution":{"observed_at":"2026-07-03T20:48:56.194931Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":"2506.17211","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-07-04T16:29:57.036901Z","title":"Ceva’s theorem","venue":null,"work_id":"cb32cd66-e7f9-4795-bb6b-7dad403f73da","year":2025},"citing_paper":{"arxiv_id":"2606.24064","last_updated":"2026-06-23T02:14:12Z","snapshot_observed_at":"2026-08-01T19:53:34.208327Z","submitted_at":"2026-06-23T02:14:12Z","title":"Beyond Trajectory Imitation: Strategy-Guided Policy Optimization for LLM Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-26T00:39:29.703711Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2606.24064"},"observation_digest":"sha256:e70327541f81894021113284211191060cec273b957e69a3a36f7ae52460b901","observation_id":"8a73fa41-b0de-4b66-9516-1b598333ed61","resolution":{"observed_at":"2026-07-04T16:29:57.038563Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-08-02T14:45:21.888557Z","title":"arXiv preprint arXiv:2506.17211 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.16205","last_updated":"2026-05-07T13:16:09Z","snapshot_observed_at":"2026-08-05T18:20:48.142001Z","submitted_at":"2026-05-07T13:16:09Z","title":"It Takes 8 Tokens: Weak-to-Strong Off-Policy RL via Auxiliary Branches","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T14:45:21.888557Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2607.16205"},"observation_digest":"sha256:bb5bf2150493d32e12071f89e2a4d94b7dc8f825f6b868686e77b1b0d0549a14","observation_id":"f74b1d37-d4a9-4f65-a79e-667f30daddb4","resolution":{"observed_at":"2026-08-02T14:45:21.888557Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-08-01T12:54:36.704591Z","title":"Bread: Branched rollouts from expert anchors bridge sft & rl for reasoning","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.19313","last_updated":"2026-07-21T17:28:40Z","snapshot_observed_at":"2026-08-06T02:26:15.730077Z","submitted_at":"2026-07-21T17:28:40Z","title":"Off-Context GRPO: Learning to Reason on Hard Problems using Privileged Information","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-01T12:54:36.704591Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2607.19313"},"observation_digest":"sha256:a71dd474239c5631a5ae9c5712c7c17898853001ac9f47d17d16e9c20ddb246b","observation_id":"4499d63a-74c1-46f9-9299-604148447797","resolution":{"observed_at":"2026-08-01T12:54:36.704591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17211","snapshot_observed_at":"2026-07-31T21:13:06.807478Z","title":"Zhuosheng Zhang, Aston Zhang, Mu Li, and Alex Smola","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.24199","last_updated":"2026-07-27T09:24:41Z","snapshot_observed_at":"2026-08-06T23:25:59.420946Z","submitted_at":"2026-07-27T09:24:41Z","title":"Reasoning to Regulate: Chain-of-Thought for Traffic Rule Understanding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-31T21:13:06.807478Z"},"links":{"cited_paper":"/paper/2506.17211","citing_paper":"/paper/2607.24199"},"observation_digest":"sha256:c45873715e4cfa880311e036a523119c4ba6af150c28668f5c436e9e67529b0f","observation_id":"cabe3706-fffd-4c42-8540-0b7c87b376a6","resolution":{"observed_at":"2026-07-31T21:13:06.807478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2506.17211/citation-record","integrity":"/paper/2506.17211/integrity","json":"/paper/2506.17211/citation-record.json","paper":"/paper/2506.17211"},"outbound":[],"paper":{"arxiv_id":"2506.17211","last_updated":"2025-06-20T17:59:07Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-06T23:28:32.860412Z","submitted_at":"2025-06-20T17:59:07Z","title":"BREAD: Branched Rollouts from Expert Anchors Bridge SFT & RL for Reasoning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 13 inbound Pith citation observations for arXiv:2506.17211."}