{"as_of":"2026-08-22T11:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ee498096510c0a6910ef3e42a56915dc814b855861f8723ca5c0d6c0c6806a7a","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T15:30:05.060588Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.29010/citation-record","integrity":"/paper/2607.29010/integrity","json":"/paper/2607.29010/citation-record.json","paper":"/paper/2607.29010"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:29:58.233810Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:58.233810Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:2449e7c3a4780077125567a710a8924b8460636f2488279036a7f3453409eff7","observation_id":"4fa7eefb-294b-4364-96c8-0a11d9fd0eed","resolution":{"observed_at":"2026-08-03T15:29:58.233810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:29:58.282830Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:58.282830Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:f0b5675ce8d3a5be1ae92cc15c4423f3b163961df23f57f37b0af0f1b410b6ac","observation_id":"a630ea69-bbc8-487c-ad8e-f003058d14b6","resolution":{"observed_at":"2026-08-03T15:29:58.282830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:29:58.410968Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:58.410968Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:d708bdf46ee2edbe9dfd1e523f6388bbaf2982be1c26d5a4234b635ee62c5b8e","observation_id":"d9fb73bd-74ca-4f37-8419-d3f073e255d0","resolution":{"observed_at":"2026-08-03T15:29:58.410968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.10207","last_updated":"2026-05-11T08:52:53Z","snapshot_observed_at":"2026-08-15T01:10:21.441499Z","submitted_at":"2026-05-11T08:52:53Z","title":"LASAR: Latent Adaptive Semantic Aligned Reasoning for Generative Recommendation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.10207","snapshot_observed_at":"2026-08-03T15:29:58.582463Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:58.582463Z"},"links":{"cited_paper":"/paper/2605.10207","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:f7c260335cd15af29f35578e2abcd5ac494c55e7c5e1ee70a5a9d1dafcca25a5","observation_id":"71209c9b-57d1-4be7-b284-077531111246","resolution":{"observed_at":"2026-08-03T15:29:58.582463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.14838","last_updated":"2024-05-23T17:54:14Z","snapshot_observed_at":"2026-07-06T18:18:51.814306Z","submitted_at":"2024-05-23T17:54:14Z","title":"From Explicit CoT to Implicit CoT: Learning to Internalize CoT Step by Step","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.14838","snapshot_observed_at":"2026-08-03T15:29:58.706983Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:58.706983Z"},"links":{"cited_paper":"/paper/2405.14838","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:358aa93ea6d55cf91fbd07fe3636da16fdac2234b1f063e9619baaf4c9cc4a20","observation_id":"50bfd9f3-1062-4d5d-a609-15291c148139","resolution":{"observed_at":"2026-08-03T15:29:58.706983Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01460","last_updated":"2023-11-02T17:59:49Z","snapshot_observed_at":"2026-08-19T20:10:00.657591Z","submitted_at":"2023-11-02T17:59:49Z","title":"Implicit Chain of Thought Reasoning via Knowledge Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01460","snapshot_observed_at":"2026-08-03T15:29:58.826144Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:58.826144Z"},"links":{"cited_paper":"/paper/2311.01460","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:2561cf47538ec2412adf378d8415034defea8ce1b3ef9a65fabae492b7382c75","observation_id":"7e432444-a9ea-42cb-9929-01eb97f9e573","resolution":{"observed_at":"2026-08-03T15:29:58.826144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:29:58.926946Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:58.926946Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:ad69d6ac51e65d6801a5d19dc6b31ae67c65309ed109e1c5e8140e994bf1df74","observation_id":"f3170dc9-caaa-45bd-ba42-c3aa49b90ea1","resolution":{"observed_at":"2026-08-03T15:29:58.926946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08063","last_updated":"2026-05-24T05:25:48Z","snapshot_observed_at":"2026-08-12T21:53:38.412397Z","submitted_at":"2026-05-08T17:50:15Z","title":"Flow-OPD: On-Policy Distillation for Flow Matching Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08063","snapshot_observed_at":"2026-08-03T15:29:59.022263Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:59.022263Z"},"links":{"cited_paper":"/paper/2605.08063","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:a13ac428d0b6797b6b4a6802551953b35be89c45d5d5ddb6d1a2a1995e00bf56","observation_id":"73401ac0-0666-49b5-b1d4-e6e2d1aad336","resolution":{"observed_at":"2026-08-03T15:29:59.022263Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.26760","last_updated":"2026-04-29T14:55:53Z","snapshot_observed_at":"2026-08-15T05:51:27.853385Z","submitted_at":"2026-04-29T14:55:53Z","title":"Factorized Latent Reasoning for LLM-based Recommendation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.26760","snapshot_observed_at":"2026-08-03T15:29:59.072317Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:59.072317Z"},"links":{"cited_paper":"/paper/2604.26760","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:99d5cf8f61cf0292748248564b15bc28e8b718e11cc5b41bb668fde65efbaa22","observation_id":"d3f1e975-6dda-4a50-bd54-2447cb285842","resolution":{"observed_at":"2026-08-03T15:29:59.072317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:29:59.292995Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:59.292995Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:cfa9ed874c809c6c4efb81a01012a8a94187bc3bba5a3afdee64b6fb4bdd8c98","observation_id":"c01fc15b-8c95-476b-a574-42258e879df3","resolution":{"observed_at":"2026-08-03T15:29:59.292995Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:29:59.461366Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:59.461366Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:c91009e544506349254906e25b72d2485caabd98101380e6fc07ab3f67fc9c2e","observation_id":"10823009-d35c-432e-a63c-64b0ff25c752","resolution":{"observed_at":"2026-08-03T15:29:59.461366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-17T06:12:37.525438Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-03T15:29:59.639190Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:59.639190Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:488ad793dcf3545b37de743d5d11184264cb414e69fca0d058bb7f26a02f1dfc","observation_id":"f09f2dc6-6094-4121-b488-13222e5450d1","resolution":{"observed_at":"2026-08-03T15:29:59.639190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:29:59.765549Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:59.765549Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:b3c9f88c28af872e11aaaf6479e1e039828dc3b54db0949b9b0b930110012f55","observation_id":"cdbf1fa1-f870-4aca-a144-9aa6fbea229c","resolution":{"observed_at":"2026-08-03T15:29:59.765549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:29:59.857388Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T15:29:59.857388Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:3627301652915fde856c229f02b4bb74fed9b67f52981009d7a908decb5ecd9a","observation_id":"6fbdf9ed-1ea1-4d64-a501-d9d1a116ee08","resolution":{"observed_at":"2026-08-03T15:29:59.857388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1503.02531","last_updated":"2015-03-09T15:44:49Z","snapshot_observed_at":"2026-08-16T18:00:58.008096Z","submitted_at":"2015-03-09T15:44:49Z","title":"Distilling the Knowledge in a Neural Network","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1503.02531","snapshot_observed_at":"2026-08-03T15:30:00.171076Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:00.171076Z"},"links":{"cited_paper":"/paper/1503.02531","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:9d7725e7c8e11a8ebf1e977510a71f3254c32043a5154630898586a213b5a34f","observation_id":"f1652b6b-8cde-4a60-bc5f-0ba2f2e24dd3","resolution":{"observed_at":"2026-08-03T15:30:00.171076Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.03677","last_updated":"2026-07-06T06:34:16Z","snapshot_observed_at":"2026-08-12T12:02:18.586804Z","submitted_at":"2026-05-05T12:15:21Z","title":"Uni-OPD: Unifying On-Policy Distillation with a Dual-Perspective Recipe","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.03677","snapshot_observed_at":"2026-08-03T15:30:00.290687Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:00.290687Z"},"links":{"cited_paper":"/paper/2605.03677","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:77330917a99b9d1ea8d65539f5b7d663e757165a6e0ef90fec48e75039581bce","observation_id":"4d206380-9b17-4670-b085-e9060be085a1","resolution":{"observed_at":"2026-08-03T15:30:00.290687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.05204","last_updated":"2026-05-26T15:05:04Z","snapshot_observed_at":"2026-08-20T01:45:59.801318Z","submitted_at":"2026-05-06T17:59:34Z","title":"D-OPSD: On-Policy Self-Distillation for Continuously Tuning Step-Distilled Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.05204","snapshot_observed_at":"2026-08-03T15:30:00.385798Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:00.385798Z"},"links":{"cited_paper":"/paper/2605.05204","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:2b2f0c0bc33f2fc983cc649e947634143351bc97b6547864b5c057c1cc8ff47e","observation_id":"1f4110bf-3ff9-40de-b50f-d53b682a0a8c","resolution":{"observed_at":"2026-08-03T15:30:00.385798Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.08432","last_updated":"2026-06-07T03:17:25Z","snapshot_observed_at":"2026-08-05T07:05:36.953114Z","submitted_at":"2026-06-07T03:17:25Z","title":"Trajectory-Refined Distillation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.08432","snapshot_observed_at":"2026-08-03T15:30:00.490830Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:00.490830Z"},"links":{"cited_paper":"/paper/2606.08432","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:f989c56c3709ed2c8df8130022c72f006e155a93dde0d471cc1e9d9ffafcb301","observation_id":"47b0cce5-aa49-4928-b357-af8fbb80cbf9","resolution":{"observed_at":"2026-08-03T15:30:00.490830Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:00.564992Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:00.564992Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:d7ed608233abb06213430ecaa6535bc96448fa7dec32dbe866dd9826c86d05fb","observation_id":"0f20630c-807b-4602-a960-faa42d7c7f2c","resolution":{"observed_at":"2026-08-03T15:30:00.564992Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:00.678271Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:00.678271Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:e7ada84f881a42dfcc41465bc6be93c5033fd9da91057d421bde215ea3e106b6","observation_id":"9b56b230-dbb3-44ec-a9b9-8812c7573083","resolution":{"observed_at":"2026-08-03T15:30:00.678271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.02994","last_updated":"2026-06-02T01:11:15Z","snapshot_observed_at":"2026-08-20T04:59:48.070681Z","submitted_at":"2026-06-02T01:11:15Z","title":"Inducing Reasoning Primitives from Agent Traces","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02994","snapshot_observed_at":"2026-08-03T15:30:00.884536Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:00.884536Z"},"links":{"cited_paper":"/paper/2606.02994","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:7394017e27bc6c5a8141908d87120a264e40fb25dacd84c464904d7a63549645","observation_id":"a6468db6-8693-4fe1-a504-eee1c8b85e68","resolution":{"observed_at":"2026-08-03T15:30:00.884536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:00.986649Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:00.986649Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:c0fe31ae0bc0a201d71459c071c75e84de03809b150f92ac92d585d13a8f46ac","observation_id":"b61d1e73-a718-4710-b87a-b991777c00cd","resolution":{"observed_at":"2026-08-03T15:30:00.986649Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.30251","last_updated":"2026-05-28T17:14:29Z","snapshot_observed_at":"2026-08-15T20:08:40.801756Z","submitted_at":"2026-05-28T17:14:29Z","title":"Same Evidence, Different Answers: Canonical-Context On-Policy Distillation for Multi-Turn Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.30251","snapshot_observed_at":"2026-08-03T15:30:01.193111Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.193111Z"},"links":{"cited_paper":"/paper/2605.30251","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:b1e9371c19746682ece5fbf719b1f8103144d94f3c89783aeeb1ab0ae553fed7","observation_id":"f84e4b93-9488-41ba-bfd5-e276f491d338","resolution":{"observed_at":"2026-08-03T15:30:01.193111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:01.281126Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.281126Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:634d9b1e8b49117ac93e18273b23462767e8bb16b86a125b53dafc225e607488","observation_id":"448317fb-d615-4032-b857-f5a023811502","resolution":{"observed_at":"2026-08-03T15:30:01.281126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16865","last_updated":"2025-06-04T11:31:59Z","snapshot_observed_at":"2026-08-15T23:54:16.492259Z","submitted_at":"2025-05-22T16:22:54Z","title":"LARES: Latent Reasoning for Sequential Recommendation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16865","snapshot_observed_at":"2026-08-03T15:30:01.442749Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.442749Z"},"links":{"cited_paper":"/paper/2505.16865","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:13562ded651995a6a7d2c2eaba597b79a5cd43879dc5be4a31fcc9291db7c6ca","observation_id":"fe329841-b873-4f00-8767-0911c444233e","resolution":{"observed_at":"2026-08-03T15:30:01.442749Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:01.527048Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.527048Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:d611358b374c318cfaa9b7bfe59e3f8346126a52cb60f7560500c74686154594","observation_id":"09266315-5b7c-4285-8afa-accdb0de978a","resolution":{"observed_at":"2026-08-03T15:30:01.527048Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:01.756328Z","title":null,"venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.756328Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:d54a986b6d6c3d8f848e68c019ae0c5d8442541fe693ff4f36d6eeae95403067","observation_id":"eb4cb58f-3dbc-4117-9525-8d65cb383d85","resolution":{"observed_at":"2026-08-03T15:30:01.756328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:01.847098Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.847098Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:b809404cf0e9660b8b5113d5f23711aee9b37b530407c4c94e6d75065f599091","observation_id":"f8f0d2a3-c476-46fa-889c-a629daecb1e6","resolution":{"observed_at":"2026-08-03T15:30:01.847098Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:01.973474Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.973474Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:a38180531f64e440b95fa627e27d1437a838f3253083525e5979569665fdfcaf","observation_id":"2fdbd909-fffb-4a89-b126-5e5453c86858","resolution":{"observed_at":"2026-08-03T15:30:01.973474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.00626","last_updated":"2026-06-18T17:00:51Z","snapshot_observed_at":"2026-08-15T00:53:33.148301Z","submitted_at":"2026-04-01T08:32:34Z","title":"A Survey of On-Policy Distillation for Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.00626","snapshot_observed_at":"2026-08-03T15:30:02.034149Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:02.034149Z"},"links":{"cited_paper":"/paper/2604.00626","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:2b6cd19b7a2f2225b34ae95d978c3b6e1f0dd8449298ac66c93520599b7f2da4","observation_id":"1be0a625-2760-437f-935f-6566e105b514","resolution":{"observed_at":"2026-08-03T15:30:02.034149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:01.675826Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.675826Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:0ddb8cd2b2173fa41f1379462d696298c0f1a93fb01fc5300607e5c4b4df3822","observation_id":"c2077bea-3bab-4d6a-be01-af54833c8c11","resolution":{"observed_at":"2026-08-03T15:30:01.675826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:02.238087Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:02.238087Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:fba15fdd7eaa2d12e0d7361f59174263cf01447081b4ef8122e066c1965299aa","observation_id":"fddb0403-2d09-4cae-9af8-653c635fa521","resolution":{"observed_at":"2026-08-03T15:30:02.238087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:02.444956Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:02.444956Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:85ed43e8b7b02eaf32d011ae9e62d3832df15a386260a90a67acc67e5814f435","observation_id":"0a5f0666-4e47-47f1-bde9-c20c58ebba53","resolution":{"observed_at":"2026-08-03T15:30:02.444956Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.06260","last_updated":"2026-06-04T15:04:34Z","snapshot_observed_at":"2026-08-15T09:30:56.734840Z","submitted_at":"2026-06-04T15:04:34Z","title":"OneReason Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.06260","snapshot_observed_at":"2026-08-03T15:30:02.512323Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:02.512323Z"},"links":{"cited_paper":"/paper/2606.06260","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:9716b9ff5a74a0ad71720e85a7cdb82b1cab91301853f27c1252cabc12b6e647","observation_id":"19d10c43-2f5b-41c7-9d62-e0c962bb3ced","resolution":{"observed_at":"2026-08-03T15:30:02.512323Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:02.593170Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:02.593170Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:5102097328536b05ab70ea8af1bcacab46293a0445f64d7a4490c375881cb0ea","observation_id":"c931cb43-2942-41c5-841f-78cf4fc751f3","resolution":{"observed_at":"2026-08-03T15:30:02.593170Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:02.682113Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:02.682113Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:f5c04429961b38b3c9116b8a91d7a301552feaef051aa05661d3a51e8c0b0a1b","observation_id":"3ca41f41-573a-42b6-bb08-c1ab34fa2788","resolution":{"observed_at":"2026-08-03T15:30:02.682113Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:02.147259Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:02.147259Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:96b36b962bf5c58a11914c7fc57a900e7c0ca8119ba0f4241ab3ee2b1a1ef285","observation_id":"61ca6ec5-0aac-4ae7-b340-d6ac1814d7b3","resolution":{"observed_at":"2026-08-03T15:30:02.147259Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:02.915813Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:02.915813Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:5d3f4fe9a82c5f301ccc35f3f3c504e11951a112bac5e03dc11f852898c725ce","observation_id":"9e5a522c-e2f9-4ce0-bc5e-a1b06abc13a1","resolution":{"observed_at":"2026-08-03T15:30:02.915813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:02.332434Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:02.332434Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:642e303768b918330b51be18d24e9813012f5240a3d544e8bf2f2c1bb8c702af","observation_id":"18396eac-f03c-4081-9231-670f17a4f68b","resolution":{"observed_at":"2026-08-03T15:30:02.332434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:03.094946Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:03.094946Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:b7c16f3355592519fea6d90e8a9390b9c47205af8ebfc3a822ea319648e8a2e7","observation_id":"b2b4eb5f-52f3-4619-9d3a-4f143b6138a4","resolution":{"observed_at":"2026-08-03T15:30:03.094946Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.26790","last_updated":"2026-06-25T09:24:09Z","snapshot_observed_at":"2026-08-13T16:34:23.083434Z","submitted_at":"2026-06-25T09:24:09Z","title":"OPID: On-Policy Skill Distillation for Agentic Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.26790","snapshot_observed_at":"2026-08-03T15:30:03.202181Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:03.202181Z"},"links":{"cited_paper":"/paper/2606.26790","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:05bd302aafcc58378218e3585b81cc5bfb2a49aec4ca67389c2fb99afdb5866e","observation_id":"4f56b06f-340f-4dcc-840a-913d6367ab4d","resolution":{"observed_at":"2026-08-03T15:30:03.202181Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:03.319931Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:03.319931Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:508686aa108a14ba89d787812fa921241bd6ffb23db7f7373ef8f77b9b8249ac","observation_id":"b44dc705-0632-469d-af28-b24f3c5bdce2","resolution":{"observed_at":"2026-08-03T15:30:03.319931Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:03.565373Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:03.565373Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:4aba4890490671cab73842530e8c0b38be5c1222f94327dbb6a47edc6e842427","observation_id":"82b34f7e-4fcb-42c9-9c09-36f0550ffd48","resolution":{"observed_at":"2026-08-03T15:30:03.565373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.14777","last_updated":"2026-07-16T09:57:18Z","snapshot_observed_at":"2026-08-20T01:11:29.310491Z","submitted_at":"2026-07-16T09:57:18Z","title":"SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.14777","snapshot_observed_at":"2026-08-03T15:30:02.812777Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:02.812777Z"},"links":{"cited_paper":"/paper/2607.14777","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:febaa76e651d2af86fdec25a578be36f6606cff06a8cb7a331c7a6df04ed2cdb","observation_id":"2530b23c-e47a-438c-ba50-134125a446bb","resolution":{"observed_at":"2026-08-03T15:30:02.812777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:03.722331Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:03.722331Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:14998c2b9effaedf608cca1241e332e99f1568b40ccae5fdc63ad20c6b750ce5","observation_id":"98c69da6-d0ef-4147-b3fa-9ab9c1cd0553","resolution":{"observed_at":"2026-08-03T15:30:03.722331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:03.009064Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:03.009064Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:a83c78d055d7c3ee38d97665722ae92daa438c431c84c527403ed32c1916b06b","observation_id":"f04eac24-b033-4397-b849-ee5f76e59fb0","resolution":{"observed_at":"2026-08-03T15:30:03.009064Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:03.934753Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:03.934753Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:7e2915595c3a04230c67b4a0ab8f93bb835a624ec0b98cdb71e5cd0e40453bcb","observation_id":"ceed71d2-3024-4c36-8072-f93a871f0713","resolution":{"observed_at":"2026-08-03T15:30:03.934753Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.21994","last_updated":"2026-08-03T09:13:52Z","snapshot_observed_at":"2026-08-16T19:48:06.502134Z","submitted_at":"2026-06-20T11:18:34Z","title":"Prefix-Guided On-Policy Distillation: Mining Golden Trajectories from Rollouts","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.21994","snapshot_observed_at":"2026-08-03T15:30:04.059671Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:04.059671Z"},"links":{"cited_paper":"/paper/2606.21994","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:228501a307ac1240d9e6f6be88354f1ccac411fd042887731e8dd69a230a6175","observation_id":"4d68f4e8-8edf-468f-a534-8b38c7a426bf","resolution":{"observed_at":"2026-08-03T15:30:04.059671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08741","last_updated":"2026-05-09T07:06:37Z","snapshot_observed_at":"2026-08-14T20:52:49.572748Z","submitted_at":"2026-05-09T07:06:37Z","title":"Training with Harnesses: On-Policy Harness Self-Distillation for Complex Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.08741","snapshot_observed_at":"2026-08-03T15:30:04.199037Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:04.199037Z"},"links":{"cited_paper":"/paper/2605.08741","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:3f0dd01e130a49cf34d9b1cb7500c89d160fc7bdce1f01ebb1cdfd4b66fef55f","observation_id":"de9f66a1-ed32-4b93-adb5-3e3d005c1756","resolution":{"observed_at":"2026-08-03T15:30:04.199037Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.12125","last_updated":"2026-02-26T13:26:22Z","snapshot_observed_at":"2026-08-16T08:35:41.330991Z","submitted_at":"2026-02-12T16:14:29Z","title":"Learning beyond Teacher: Generalized On-Policy Distillation with Reward Extrapolation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.12125","snapshot_observed_at":"2026-08-03T15:30:03.450862Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:03.450862Z"},"links":{"cited_paper":"/paper/2602.12125","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:83a7c6a937d5cfaae55c2e93bfcd191ef1a33f1eb6ed35522d246315809b892a","observation_id":"eb0e890e-4eb7-4965-ab66-a0a520e81390","resolution":{"observed_at":"2026-08-03T15:30:03.450862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:04.422163Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:04.422163Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:7f226f668c3b43a2091fe67909bc7d918f081bd07bc34ac2485c0fa5e23cb93e","observation_id":"7e5b01b8-1cd9-49d2-b2af-73a97c847b48","resolution":{"observed_at":"2026-08-03T15:30:04.422163Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.17152","last_updated":"2024-05-06T02:05:45Z","snapshot_observed_at":"2026-08-21T23:52:21.846075Z","submitted_at":"2024-02-27T02:37:37Z","title":"Actions Speak Louder than Words: Trillion-Parameter Sequential Transducers for Generative Recommendations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.17152","snapshot_observed_at":"2026-08-03T15:30:03.634087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:03.634087Z"},"links":{"cited_paper":"/paper/2402.17152","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:2079fbe56910deb4bee8d33947a23be892ce77b687ca943be0a30837e22aea2f","observation_id":"fb1f5113-06cc-4f90-9d82-b68176390b07","resolution":{"observed_at":"2026-08-03T15:30:03.634087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:04.626154Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:04.626154Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:f6caa98bb473c204b11f3d3fa145277f827c0f10daa4af44a600c6d6514dd034","observation_id":"c5eebe51-5c0f-4671-8029-fd9c57a1ceac","resolution":{"observed_at":"2026-08-03T15:30:04.626154Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:03.821003Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:03.821003Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:ad022de6efd9ce19cfae5357354d80a2345f8e9829a38f635e091cd6949f5582","observation_id":"a08bd2dc-1448-40a6-8117-0ff6f5efe91d","resolution":{"observed_at":"2026-08-03T15:30:03.821003Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:04.801042Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:04.801042Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:2d1c6f3d6814972655c75dd51de0941a79a3e36118367f60aadb6663ae3823a1","observation_id":"ce181fe4-5c78-49d9-8570-07fd8c2fc142","resolution":{"observed_at":"2026-08-03T15:30:04.801042Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:05.060588Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:05.060588Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:46dff69b60b4f3a0ffba530d84ba36756317bb33b50f06f561f660380ffa0437","observation_id":"7862583a-00af-4dcf-a1c5-728178211f3c","resolution":{"observed_at":"2026-08-03T15:30:05.060588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.15591","last_updated":"2026-07-24T12:46:50Z","snapshot_observed_at":"2026-08-14T22:01:57.524320Z","submitted_at":"2026-07-17T03:25:43Z","title":"RecGPT-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.15591","snapshot_observed_at":"2026-08-03T15:30:04.315177Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:04.315177Z"},"links":{"cited_paper":"/paper/2607.15591","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:a3078cafc8011214c7f0275db3ea86266b3e084c069707fae3e3bf936cde617c","observation_id":"a38a85e8-97e3-4396-b78f-6dffcf1f4fda","resolution":{"observed_at":"2026-08-03T15:30:04.315177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.05804","last_updated":"2026-07-07T03:56:35Z","snapshot_observed_at":"2026-08-16T13:49:03.913563Z","submitted_at":"2026-07-07T03:56:35Z","title":"TurnOPD: Making On-Policy Distillation Turn-Aware for Efficient Long-Horizon Agent Training","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.05804","snapshot_observed_at":"2026-08-03T15:30:04.524394Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:04.524394Z"},"links":{"cited_paper":"/paper/2607.05804","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:f33794baf0a5c5ba3d39f2399d073cd2cad97466bd72afb512da54de6edc839e","observation_id":"9ac94131-3ac9-4505-a9da-83b605b12cdb","resolution":{"observed_at":"2026-08-03T15:30:04.524394Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:04.748693Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:04.748693Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:38abb243d712957350b2350a077c146b6456a82b1c108c51bf34e4305886f613","observation_id":"a571c856-a2cf-4195-a9a0-59e3ed1126c6","resolution":{"observed_at":"2026-08-03T15:30:04.748693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.09888","last_updated":"2026-06-03T09:10:06Z","snapshot_observed_at":"2026-08-07T11:36:12.913175Z","submitted_at":"2026-06-03T09:10:06Z","title":"SinkRec: Mitigating Semantic State Sink in Long Sequence Recommendation with Memory-Conditioned Gated Delta Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.09888","snapshot_observed_at":"2026-08-03T15:30:04.906512Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:04.906512Z"},"links":{"cited_paper":"/paper/2606.09888","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:8a17f0594176194f6622beb8e9e36fc178bd1fc91d7aef757edfc52f8bd5af27","observation_id":"1c74bb90-2789-4131-9f9d-1a6be1377e98","resolution":{"observed_at":"2026-08-03T15:30:04.906512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1511.06939","last_updated":"2016-03-29T14:52:58Z","snapshot_observed_at":"2026-08-15T14:18:11.908702Z","submitted_at":"2015-11-21T23:42:59Z","title":"Session-based Recommendations with Recurrent Neural Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1511.06939","snapshot_observed_at":"2026-08-03T15:30:00.088824Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":2015,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:00.088824Z"},"links":{"cited_paper":"/paper/1511.06939","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:24ab8e2f58c367a6f6a8c26b823440c5da5282df70fb30e3ac238860defe6aff","observation_id":"cb4583d9-539e-48dd-a4c2-dcd0021f50a4","resolution":{"observed_at":"2026-08-03T15:30:00.088824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T15:30:01.909888Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.909888Z"},"links":{"citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:4e832f0d5ff5fbdb2be3a49a7cfa1f109784ca0a736848544c57547fee73a40b","observation_id":"506649c9-adda-44d3-8dcc-959afd5b08ee","resolution":{"observed_at":"2026-08-03T15:30:01.909888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.03900","last_updated":"2024-06-29T14:07:20Z","snapshot_observed_at":"2026-08-19T22:02:40.018663Z","submitted_at":"2024-03-06T18:00:15Z","title":"Mamba4Rec: Towards Efficient Sequential Recommendation with Selective State Space Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.03900","snapshot_observed_at":"2026-08-03T15:30:01.348232Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.348232Z"},"links":{"cited_paper":"/paper/2403.03900","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:34a85b3d07d89299a0f1a86f56a3c397e8e1d61e589d15a1cc5c18ca3f505209","observation_id":"224b06b4-c96a-4c80-b5d7-787edf7fec68","resolution":{"observed_at":"2026-08-03T15:30:01.348232Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.02312","last_updated":"2026-05-07T14:29:10Z","snapshot_observed_at":"2026-08-09T22:23:43.207474Z","submitted_at":"2025-10-02T17:59:51Z","title":"KaVa: Latent Reasoning via Compressed KV-Cache Distillation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.02312","snapshot_observed_at":"2026-08-03T15:30:00.766699Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:00.766699Z"},"links":{"cited_paper":"/paper/2510.02312","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:68137f3eae615a4e08547d29249259e32ca3655e740ec4bccc8346566486c198","observation_id":"eb10d926-89bb-4182-9d50-9584e1d65dfc","resolution":{"observed_at":"2026-08-03T15:30:00.766699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2607.04763","last_updated":"2026-07-26T14:17:18Z","snapshot_observed_at":"2026-08-15T22:59:02.741838Z","submitted_at":"2026-07-06T07:56:53Z","title":"Multi-Turn On-Policy Distillation with Prefix Replay","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2607.04763","snapshot_observed_at":"2026-08-03T15:30:01.059028Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation","version":1},"reference_index":2026,"source":"pdf_text","source_observed_at":"2026-08-03T15:30:01.059028Z"},"links":{"cited_paper":"/paper/2607.04763","citing_paper":"/paper/2607.29010"},"observation_digest":"sha256:e7b81af7e3577d955dc781563fdd275d44e2f35590bd0ae1e68106df4b99e2db","observation_id":"09d3c1f3-c066-4967-a71c-eaaffacc1212","resolution":{"observed_at":"2026-08-03T15:30:01.059028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.29010","last_updated":"2026-07-31T04:24:16Z","latest_version":1,"primary_category":"cs.IR","snapshot_observed_at":"2026-08-18T09:12:13.607797Z","submitted_at":"2026-07-31T04:24:16Z","title":"EvoReason: Self-Evolving Reasoning Primitive-Guided On-Policy Distillation for Latent Reasoning in Generative Recommendation"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":65,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 22 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2607.29010."}