{"as_of":"2026-08-16T15:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:d8b498a38362e0c5d982b5a571a635311483d36093d5bba5e78aa236281e683c","coverage":[{"denominator":65,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":65,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T16:44:36.855313Z","state":"measured"},{"denominator":65,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":65,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-16T06:30:59.297886+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.02528/citation-record","integrity":"/paper/2509.02528/integrity","json":"/paper/2509.02528/citation-record.json","paper":"/paper/2509.02528"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.861772Z","title":"A tail inequality for suprema of unbounded empirical processes with applications to markov chains","venue":null,"work_id":"a98c6485-283a-460e-9952-74b539faad4b","year":2008},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.574676Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:c9319ef6c3872334fb0394097b836d8ad0ca06d7fa6bf71dc8319baa4a0c96e0","observation_id":"ce35b655-a1a8-4db1-b4df-c9f628aeb06a","resolution":{"observed_at":"2026-08-15T16:44:37.866601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.846901Z","title":null,"venue":null,"work_id":"c0ddad55-68a5-434f-95d4-3f05858dd226","year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.579570Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:609acbe888f8c6313be0d1f3871236ee02090ec14f559a6bde5302c1c1ff771d","observation_id":"a6ea8990-d4fe-4572-be22-84bc2b3ff7b3","resolution":{"observed_at":"2026-08-15T16:44:37.852251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.05780","last_updated":"2019-09-05T02:31:13Z","snapshot_observed_at":"2026-08-14T19:03:27.034761Z","submitted_at":"2018-06-15T01:35:03Z","title":"Surprising Negative Results for Generative Adversarial Tree Search","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.05780","snapshot_observed_at":"2026-08-15T16:44:36.584243Z","title":"Azizzadenesheli, B","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.584243Z"},"links":{"cited_paper":"/paper/1806.05780","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:67595ee79912aaca01e3b9214ff6f8325bc3a72503d0839684599681dd8cd2e9","observation_id":"2e81c948-05bc-48b6-a9c7-f80e217370dd","resolution":{"observed_at":"2026-08-15T16:44:36.584243Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.832919Z","title":null,"venue":null,"work_id":"5494da17-8678-4a4f-8eab-83843d538dbe","year":2005},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.589195Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:e1aa1e97f55d2a29196629eb84d111051f4e6b1fd0717a8942553815d6e86458","observation_id":"bba7200c-4b76-4ce5-bbf4-44609ff0e3a6","resolution":{"observed_at":"2026-08-15T16:44:37.837493Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20686","last_updated":"2025-05-27T03:58:50Z","snapshot_observed_at":"2026-08-09T17:00:52.421557Z","submitted_at":"2025-05-27T03:58:50Z","title":"Accelerating RL for LLM Reasoning with Optimal Advantage Regression","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.20686","snapshot_observed_at":"2026-08-15T16:44:36.593554Z","title":"Brantley, M","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.593554Z"},"links":{"cited_paper":"/paper/2505.20686","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:8bc4f7cf1a5eaf6204c35dd8d2616d4ee4694e7c3e3e6fa2abef3d2079d78ed6","observation_id":"66c207b8-7aa6-4645-a53a-88af4e9fa20e","resolution":{"observed_at":"2026-08-15T16:44:36.593554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.13301","last_updated":"2024-01-04T19:11:25Z","snapshot_observed_at":"2026-08-09T16:20:23.732146Z","submitted_at":"2023-05-22T17:57:41Z","title":"Training Diffusion Models with Reinforcement Learning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.13301","snapshot_observed_at":"2026-08-15T16:44:36.598281Z","title":"Black, M","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.598281Z"},"links":{"cited_paper":"/paper/2305.13301","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:903efaa820fef0bd6d9f07a62d65bb61bed9761233eeba3d6d5e1a177551493f","observation_id":"3edd4543-5a71-4fbf-a4af-38c8c0b488bf","resolution":{"observed_at":"2026-08-15T16:44:36.598281Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.818111Z","title":"Approximation variationnelle des probl \\`e mes aux limites","venue":null,"work_id":"8800fcbe-b1a2-460c-9d00-368c7e042756","year":1964},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.603337Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:d3fb96ec8f799621d6b652e1a51d64b6e66b38f956e873d407f744c2193e99e6","observation_id":"f5a455da-2a25-47b4-b2b4-3055f47e7556","resolution":{"observed_at":"2026-08-15T16:44:37.822868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.607399Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.607399Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:8e4374cc1b1563ec5d2a1f8da6a529666d4841f2a93bcdb693cccced43e4279e","observation_id":"5db587be-6eb7-48db-997a-5668af502f1a","resolution":{"observed_at":"2026-08-15T16:44:36.607399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.794108Z","title":null,"venue":null,"work_id":"1385e557-a47d-4507-9f67-5c2a5403366f","year":1951},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.611684Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:dc8f2e4a06a4a91e5f6a18bbbbb9c84ebd436e307274c90975101b27b1874a2a","observation_id":"5b33d044-71e8-48e4-af55-04559caf6201","resolution":{"observed_at":"2026-08-15T16:44:37.798980Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.779565Z","title":"Tail bounds via generic chaining","venue":null,"work_id":"d695832b-9644-419d-b269-97747ed953a5","year":2015},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.616019Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:a59dd934f30c504d8b7b854538e6c207e54d3e57efe492c3177caff382af49f7","observation_id":"357fdbad-4e84-4e50-bb3d-e06777dadda4","resolution":{"observed_at":"2026-08-15T16:44:37.784130Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.764550Z","title":"Dhariwal and A","venue":null,"work_id":"20c3aa8b-a361-411d-a5b6-fd4e418718d2","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.620527Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:d86c86af112d0540642b836ce45d8d71e8ef8a157b4827584feda1755f1e4c1a","observation_id":"aab51627-1e16-4a97-8e84-3dca7ef1dc5b","resolution":{"observed_at":"2026-08-15T16:44:37.769689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.748695Z","title":null,"venue":null,"work_id":"9fb7d638-ec30-4454-a37d-5676d78647aa","year":2018},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.624739Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:e28dd8b726056d87c3bc7f5ddb955d0ab23deb96d8d757b519ca668b99c3f71d","observation_id":"24deabe8-76ca-41a4-99f5-e158d3960904","resolution":{"observed_at":"2026-08-15T16:44:37.753577Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.13362","last_updated":"2024-09-19T20:42:34Z","snapshot_observed_at":"2026-08-13T12:54:43.328196Z","submitted_at":"2023-01-31T01:37:48Z","title":"Optimizing DDPM Sampling with Shortcut Fine-Tuning","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.13362","snapshot_observed_at":"2026-08-15T16:44:36.629752Z","title":"Fan and K","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.629752Z"},"links":{"cited_paper":"/paper/2301.13362","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:ae59b64bd29b3284486e778daf16fc64c80b75bc4893689750e0e60f9a5d5acc","observation_id":"1f32e9d0-15c2-45a8-ba95-835510272c6c","resolution":{"observed_at":"2026-08-15T16:44:36.629752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.733969Z","title":null,"venue":null,"work_id":"18a940c0-08b7-42a1-be46-004ddd0551ea","year":1977},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.634175Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:1911cac41cd47c51087eeb1bb2b898abe26accf8aaaccc98960f4ffb6723d17e","observation_id":"d9804de7-6b84-4161-9bb0-0592b1e077f2","resolution":{"observed_at":"2026-08-15T16:44:37.738600Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.05744","last_updated":"2021-03-09T22:34:13Z","snapshot_observed_at":"2026-08-11T03:35:57.528946Z","submitted_at":"2021-03-09T22:34:13Z","title":"Deep neural network approximation for high-dimensional parabolic Hamilton-Jacobi-Bellman equations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.05744","snapshot_observed_at":"2026-08-15T16:44:36.638288Z","title":"Grohs and L","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.638288Z"},"links":{"cited_paper":"/paper/2103.05744","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:982cdab8b913476089d3161057312ff69494c8808b61f0e13821a07eda75a932","observation_id":"16f0848d-8fed-4a6c-a665-7a39131a2566","resolution":{"observed_at":"2026-08-15T16:44:36.638288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04832","last_updated":"2025-08-10T14:23:13Z","snapshot_observed_at":"2026-08-16T13:20:32.511696Z","submitted_at":"2024-09-07T13:55:45Z","title":"Reward-Directed Score-Based Diffusion Models via q-Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04832","snapshot_observed_at":"2026-08-15T16:44:36.642599Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.642599Z"},"links":{"cited_paper":"/paper/2409.04832","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:c5085d20def8103c0c65e2d2441556f29b782f278610369d87522b22346ffad2","observation_id":"0d6da94f-2dbe-468f-9296-fb9fcfe3e5e5","resolution":{"observed_at":"2026-08-15T16:44:36.642599Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.717766Z","title":null,"venue":null,"work_id":"918cf4eb-6d11-4b58-a6e4-a0fd157a7ff6","year":2020},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.646957Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:ab8c8eb73bff0f9d8b8242a11c18feee83d8072d631bf4079e6bcfdbc3037b46","observation_id":"efe4ebd1-85f6-4f42-8577-660cb3ee0856","resolution":{"observed_at":"2026-08-15T16:44:37.723557Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.701456Z","title":null,"venue":null,"work_id":"c7710c0d-36b9-4835-8bb3-2b3974b99652","year":1950},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.651274Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:ecd636cc399c9ef305a3254fe22590790776e03b8eadec98e23740198f848018","observation_id":"5e7f336f-cef4-419c-8c8e-a94b77f526eb","resolution":{"observed_at":"2026-08-15T16:44:37.706807Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18164","last_updated":"2025-08-29T11:26:22Z","snapshot_observed_at":"2026-08-15T18:48:52.611037Z","submitted_at":"2024-12-24T04:55:46Z","title":"Stochastic Control for Fine-tuning Diffusion Models: Optimality, Regularity, and Convergence","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.18164","snapshot_observed_at":"2026-08-15T16:44:36.655600Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.655600Z"},"links":{"cited_paper":"/paper/2412.18164","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:0c45d1ab405cf3f8798e95d15e9df27bac4bcfc2d531cbbaceeb4500c8c7fdcc","observation_id":"86941e3d-e0ef-4513-8728-6c54adc717d2","resolution":{"observed_at":"2026-08-15T16:44:36.655600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.04133","last_updated":"2017-08-10T19:20:15Z","snapshot_observed_at":"2026-08-15T03:09:17.358218Z","submitted_at":"2017-08-10T19:20:15Z","title":"Reproducibility of Benchmarked Deep Reinforcement Learning Tasks for Continuous Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.04133","snapshot_observed_at":"2026-08-15T16:44:36.660336Z","title":"Islam, P","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.660336Z"},"links":{"cited_paper":"/paper/1708.04133","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:771c7ad84d852f7f429819355c66bff2c4061128df53545df1e58aded6b69502","observation_id":"581b27d2-9b22-4ada-8b96-78cca4a8b197","resolution":{"observed_at":"2026-08-15T16:44:36.660336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.686461Z","title":null,"venue":null,"work_id":"560ae4fb-fdc8-4b85-885c-68b61e5ab338","year":2020},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.664682Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:2481f262cbc15b1ba6edbb7acad9a7d345bad337d8b9b62eb76f9ef12d235ce5","observation_id":"7ff8cc8d-fada-4d31-afbe-1c2f2bfe6a60","resolution":{"observed_at":"2026-08-15T16:44:37.690904Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.668860Z","title":"Jia and X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.668860Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:a39960aea4f37024943889ae0d086bd3e5e691cc02140f0db48fc23e620da64b","observation_id":"056644f1-4f77-4a11-bcce-3ccfd8d8673e","resolution":{"observed_at":"2026-08-15T16:44:36.668860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.673059Z","title":"Jia and X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.673059Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:3fa4627053fb82650c993a332504862e2de70ef8a7b275ca25c1c85de96bacae","observation_id":"348ebea6-7878-4707-a245-fc2007bb9851","resolution":{"observed_at":"2026-08-15T16:44:36.673059Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.677418Z","title":"Jia and X","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.677418Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:6986f7b0e2a09506a3c678a36f88382293197859c495c5fe96a0b48fa9f25efd","observation_id":"24f46d19-dba4-4178-bcee-82886277c09f","resolution":{"observed_at":"2026-08-15T16:44:36.677418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.643764Z","title":null,"venue":null,"work_id":"2e83daa5-416c-4588-81b7-1ef2918da841","year":2005},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.681658Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:8222654bc3b845fda5a774b8cd78a69beed450ac2763e57b96ce1228adf43696","observation_id":"84d92b7d-6826-4887-bbd7-4d64bced1a9f","resolution":{"observed_at":"2026-08-15T16:44:37.648077Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.630134Z","title":"Korshunova, N","venue":null,"work_id":"9b5aead8-b18d-4979-8078-f71ddc583ae9","year":2022},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.685931Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:5050cb607c7e29974824370c573b41a3dd9eb271c7438dfebfd45104d4ef78d0","observation_id":"86cfa3e9-2e88-447a-9a5c-ac0ebecdb789","resolution":{"observed_at":"2026-08-15T16:44:37.634586Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.614755Z","title":"Kakade and J","venue":null,"work_id":"2f721cfa-77b4-49b9-8b7a-699dfc03897d","year":2002},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.690568Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:d7e33c55140f1a2365583e5fcb7df92947e05be6b8cfcc928b92f836ea37ca64","observation_id":"9a58790a-e4fc-4fff-9dcc-634caceb5191","resolution":{"observed_at":"2026-08-15T16:44:37.619924Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.598815Z","title":"Koltchinskii","venue":null,"work_id":"ecbf6c4c-d672-4a12-8d24-94e62d745116","year":2008},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.694800Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:3f52514eb3aeb45bcef54549fde4fb19cb436b0066f389ba7f7a4a4694646316","observation_id":"227bb8ea-8bc6-4517-b426-a2a0bb38f526","resolution":{"observed_at":"2026-08-15T16:44:37.603426Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.583384Z","title":null,"venue":null,"work_id":"0284342f-49eb-4c46-aa30-fdf4cc8a6e9b","year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.699081Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:7bbfb46e0cabd10ea464177f0a1e88d5fc861c4c6ac4185f02b649c29d91e969","observation_id":"42a7b6b8-ca5f-48cb-892d-cef824af496c","resolution":{"observed_at":"2026-08-15T16:44:37.588155Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2110.06897","last_updated":"2021-11-13T02:25:51Z","snapshot_observed_at":"2026-08-16T11:51:28.296563Z","submitted_at":"2021-10-13T17:26:31Z","title":"Machine Learning For Elliptic PDEs: Fast Rate Generalization Bound, Neural Scaling Law and Minimax Optimality","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.06897","snapshot_observed_at":"2026-08-15T16:44:36.703386Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.703386Z"},"links":{"cited_paper":"/paper/2110.06897","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:adabbd8cc8c8148643a80185a1503e5cda6dc5bf60eaac78956b59935ae137f5","observation_id":"66dfb0aa-481a-4a23-92ab-a2b26db2bc0f","resolution":{"observed_at":"2026-08-15T16:44:36.703386Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.568823Z","title":null,"venue":null,"work_id":"23813c05-6531-4d1c-b17b-f158cf05dd9d","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.707821Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:17782812cdd9daba66b856725fd9f086e8a4e88259a6dddc886d4bbe72b102e6","observation_id":"3a182fd1-1462-4625-bcbb-8be9fead9435","resolution":{"observed_at":"2026-08-15T16:44:37.573562Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1305.4825","last_updated":"2016-09-17T09:42:53Z","snapshot_observed_at":"2026-08-15T00:17:08.643949Z","submitted_at":"2013-05-21T14:02:51Z","title":"Learning subgaussian classes : Upper and minimax bounds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1305.4825","snapshot_observed_at":"2026-08-15T16:44:36.712015Z","title":"Lecu \\'e and S","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.712015Z"},"links":{"cited_paper":"/paper/1305.4825","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:f7d5a1472b8f576f51116df61efe9e01383c516c738d19a97a395511f7262d70","observation_id":"85f2a205-f404-4abe-b49f-e97c7cff4591","resolution":{"observed_at":"2026-08-15T16:44:36.712015Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.04991","last_updated":"2025-08-08T02:46:14Z","snapshot_observed_at":"2026-08-16T13:20:27.883250Z","submitted_at":"2024-09-08T06:05:51Z","title":"Estimates of the numerical density for stochastic differential equations with multiplicative noise","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.04991","snapshot_observed_at":"2026-08-15T16:44:36.716547Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.716547Z"},"links":{"cited_paper":"/paper/2409.04991","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:5aabaf92ad6d7083811e27e525d955e5c1e1ffaf2f2c5160e9a94a3db99f76f9","observation_id":"f38cec05-2977-4b70-91a6-479ccf2ed169","resolution":{"observed_at":"2026-08-15T16:44:36.716547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.553853Z","title":"Madelung","venue":null,"work_id":"b1e2cc5f-a4d0-4a52-86ad-847212b64edc","year":1927},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.720978Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:51db9fce3f6cc417f1b44d7ba750a0c43e36d12d38fbdf9557e80ff4a686ea56","observation_id":"eacea762-4c8f-4b48-a435-b039fbcbacee","resolution":{"observed_at":"2026-08-15T16:44:37.558758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.539699Z","title":"Munos and P","venue":null,"work_id":"25b0812e-f436-4666-bdde-76ad96ce2f3b","year":1997},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.725555Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:cf9bb43cde9268cff1a7cd3467c671e6c7a2acae06b0053e51fa8626c62a829d","observation_id":"4475f4d1-ef11-4fa7-ac43-d3afba11cd90","resolution":{"observed_at":"2026-08-15T16:44:37.544291Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.729788Z","title":"Mendelson","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.729788Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:5b6517eacf62798da0a1e7a16fcedc921e80fa6cb49e4bfd29644de24d2a06f6","observation_id":"fb479064-3351-45b3-9509-d31099310be8","resolution":{"observed_at":"2026-08-15T16:44:36.729788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.515448Z","title":"Muhle-Karbe, J","venue":null,"work_id":"d266904c-08b1-4e6e-a389-d568141776be","year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.734279Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:040e4f92129a70469ede9376253a5e71a3a2a909afedd633f778c7a5d1f5a0a8","observation_id":"1710e4d7-edad-49d5-b291-03d653ba5764","resolution":{"observed_at":"2026-08-15T16:44:37.520532Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.04297","last_updated":"2025-02-06T18:39:03Z","snapshot_observed_at":"2026-08-16T04:54:00.316342Z","submitted_at":"2025-02-06T18:39:03Z","title":"Statistical guarantees for continuous-time policy evaluation: blessing of ellipticity and new tradeoffs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.04297","snapshot_observed_at":"2026-08-15T16:44:36.738417Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.738417Z"},"links":{"cited_paper":"/paper/2502.04297","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:47156358e21b6fc66c5d4e6ef692df797605452ea8111663e075936e00b075b1","observation_id":"e4051267-c4d5-497c-8c65-eecdcd60cc37","resolution":{"observed_at":"2026-08-15T16:44:36.738417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.501681Z","title":"Optimal oracle inequalities for projected fixed-point equations, with applications to policy evaluation","venue":null,"work_id":"0823aa7a-8a2c-45b2-a86a-e6e8edef5348","year":2023},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.742846Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:d00640348268d0596dbb1c3bf71d5384272fba489732a962b4b64255e9597103","observation_id":"089c8cea-3fa2-487d-ade6-293c0721c48e","resolution":{"observed_at":"2026-08-15T16:44:37.506171Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.746982Z","title":"Menozzi, A","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.746982Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:76dd0101f71c31cd629e419ffe06503e963474b5b0bee97ecf44571fa61dfcf4","observation_id":"7be2d523-daa4-4493-a051-62d319c03827","resolution":{"observed_at":"2026-08-15T16:44:36.746982Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.05966","last_updated":"2024-07-08T14:05:03Z","snapshot_observed_at":"2026-08-16T13:36:09.446614Z","submitted_at":"2024-07-08T14:05:03Z","title":"On Bellman equations for continuous-time policy evaluation I: discretization and approximation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.05966","snapshot_observed_at":"2026-08-15T16:44:36.751413Z","title":"Mou and Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.751413Z"},"links":{"cited_paper":"/paper/2407.05966","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:67f65951a3895077b759c576f7265a434eeed34521f80f5e1b1dcbe7e2917941","observation_id":"0e4bb261-589d-4c82-bc20-338bd2824240","resolution":{"observed_at":"2026-08-15T16:44:36.751413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.478837Z","title":"Nemirovski, A","venue":null,"work_id":"857628d7-e95a-4849-8b72-fa3b0e980f6b","year":2009},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.755747Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:58acc6acb2ede84eee45f97c7adbba55b75331eff3cc4695e6171428985dbdb0","observation_id":"d40c9c10-e1b2-49ce-a523-11bd20dc49ad","resolution":{"observed_at":"2026-08-15T16:44:37.483121Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.463645Z","title":"The Malliavin calculus and related topics","venue":null,"work_id":"26cf432f-8145-424f-9576-5e5a7a402a4d","year":2006},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.760228Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:2fd93a0a63c6faab4c0502382ddac9078874a16d22495c84798a46286552a24a","observation_id":"1cf5d741-49f8-4b6f-b147-d7e3e7dc64ea","resolution":{"observed_at":"2026-08-15T16:44:37.469223Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.449082Z","title":"Ouyang, J","venue":null,"work_id":"770e5d90-12cd-40d3-8069-f7404c405da0","year":2022},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.764450Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:f5871b6ea005ca7e9edf9e9d673fdb9ba42c0b69521e060620521df43f5d8fb5","observation_id":"47be84e9-3cdf-4645-afd0-945a359f1801","resolution":{"observed_at":"2026-08-15T16:44:37.454023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.434525Z","title":null,"venue":null,"work_id":"7b96fbdc-120f-484c-a4ac-71a3badb3197","year":2016},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.768422Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:af085f8f667d5b37674eb597a66b3122295b3b4bbc65af20db3029bf0a3f8293","observation_id":"9711309c-3e0d-4b1d-a1ac-fcfb2a64a428","resolution":{"observed_at":"2026-08-15T16:44:37.438840Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.420340Z","title":"Sirignano and K","venue":null,"work_id":"21cc72c4-0ff8-457f-9661-d97d4856898c","year":2018},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.772563Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:177d1f1974b493edd76924f4c1248eaa06123aba690b08ef00f5d6b2e5f4a1ba","observation_id":"91b4fd3d-bd46-4ed0-b514-dacffc647c89","resolution":{"observed_at":"2026-08-15T16:44:37.424838Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-15T16:44:36.776671Z","title":null,"venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.776671Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:fc093e8b19387d77b9723c82e9ed493b505f48dc378754314208e3d6b02dd950","observation_id":"f5efafcc-9ee1-400b-b60d-7a2fc52a5f62","resolution":{"observed_at":"2026-08-15T16:44:36.776671Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-15T16:44:36.781087Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.781087Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:e6c1ebfe65a318e0b63c449923542e289a96a89ed76fa6566488d6147cc29c71","observation_id":"d685b4b0-985a-4518-99ea-b9695def74be","resolution":{"observed_at":"2026-08-15T16:44:36.781087Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.785848Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.785848Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:e147454aaa3b94a1900b9fef51ec798f5e85802d61acc734cc5c08d41f87ce10","observation_id":"85048588-d7ea-45fd-afb4-2a59d9356843","resolution":{"observed_at":"2026-08-15T16:44:36.785848Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.407019Z","title":"Theodorou, J","venue":null,"work_id":"511472ca-43b8-4412-bd86-56e69e3e19d5","year":2010},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.790041Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:fa012e5fafe7a692f3e36f9103b3038909832e654eb4f10d9f03717baf39f5e5","observation_id":"2c9fda2c-941c-4e37-b2c2-7afdd0c9cf02","resolution":{"observed_at":"2026-08-15T16:44:37.411284Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.393247Z","title":null,"venue":null,"work_id":"fb01a10f-a853-48d5-b139-164022bd4df4","year":2006},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.795153Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:1840e7ea4fd9e9efc0424005bc3f4d0d937fbdd0cac3bffb4fabb6c92c8283dc","observation_id":"15bce076-6d95-4e1a-afc8-82eee8824747","resolution":{"observed_at":"2026-08-15T16:44:37.397552Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.379802Z","title":"Tang and R","venue":null,"work_id":"e0a69557-3b73-4578-894b-740bd6fbc5e2","year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.799325Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:096705121ae7d7e37cd1af52a80639264bb3c5463905e244925a675b74c0c03e","observation_id":"94fc095e-107d-4a16-9724-9c243e65ea04","resolution":{"observed_at":"2026-08-15T16:44:37.384029Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15194","last_updated":"2024-02-28T09:21:46Z","snapshot_observed_at":"2026-08-16T14:15:58.450132Z","submitted_at":"2024-02-23T08:54:42Z","title":"Fine-Tuning of Continuous-Time Diffusion Models as Entropy-Regularized Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15194","snapshot_observed_at":"2026-08-15T16:44:36.803558Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.803558Z"},"links":{"cited_paper":"/paper/2402.15194","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:0ea818bed3c40cf42f99fef1453c3bbf973ddb99f1488279ce9dc879f0b380f0","observation_id":"6ee942e2-c912-4809-a2e2-485bb3e2e01f","resolution":{"observed_at":"2026-08-15T16:44:36.803558Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16359","last_updated":"2024-07-18T08:21:54Z","snapshot_observed_at":"2026-08-16T14:15:25.383069Z","submitted_at":"2024-02-26T07:24:32Z","title":"Feedback Efficient Online Fine-Tuning of Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16359","snapshot_observed_at":"2026-08-15T16:44:36.807712Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.807712Z"},"links":{"cited_paper":"/paper/2402.16359","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:7b9e0c0551d3598f7ac33749457af58416f0b327c83790f774719a1700e869c1","observation_id":"bd38fb5c-88b1-4662-a24a-be437b15d194","resolution":{"observed_at":"2026-08-15T16:44:36.807712Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.13734","last_updated":"2024-07-18T17:35:32Z","snapshot_observed_at":"2026-08-16T13:32:57.699401Z","submitted_at":"2024-07-18T17:35:32Z","title":"Understanding Reinforcement Learning-Based Fine-Tuning of Diffusion Models: A Tutorial and Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.13734","snapshot_observed_at":"2026-08-15T16:44:36.812472Z","title":"Uehara, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.812472Z"},"links":{"cited_paper":"/paper/2407.13734","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:ded0fc3831c96fa01273156fc767e66f21acae5ffe4569a41e9527c5362c568b","observation_id":"2e624b8a-a421-4994-b9c7-48d723e40b17","resolution":{"observed_at":"2026-08-15T16:44:36.812472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.816826Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.816826Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:d68a6b2e9fa8a5c5abca1cd56c23c44939f9afcb156eb92a64a183bda1c756c4","observation_id":"fbdc3ec1-920a-40dc-8ae6-028382bbec99","resolution":{"observed_at":"2026-08-15T16:44:36.816826Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.355587Z","title":"Weisz, P","venue":null,"work_id":"e70c8bcd-2c6c-4cb4-bcd5-421841839ccf","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.821225Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:ff21ec3396b9cab96f24b7aef28a2578e80e6cc83c4c3db88e6debc5032d711c","observation_id":"45695990-f541-4903-b0cf-45e7ee65ed2e","resolution":{"observed_at":"2026-08-15T16:44:37.360790Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.340595Z","title":null,"venue":null,"work_id":"ddb8fbaa-4194-4ed0-b897-9c7e922e17d1","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.825462Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:a55bed7d3ce855368ea7084e5b76b44287aeeb009ba59743a5d65b85a16a5a7e","observation_id":"dea01282-61f6-4be2-b549-28e660392cfc","resolution":{"observed_at":"2026-08-15T16:44:37.345095Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.325902Z","title":"Xie and N","venue":null,"work_id":"96d219d1-d197-48fd-b75a-7a1e5415fd68","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.829886Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:f532659e4d74398fc08c63f9faefe4ff1b894aac0078411bb350b3112c129ec0","observation_id":"1dd41a41-61cc-4e4f-8b26-754abea3338e","resolution":{"observed_at":"2026-08-15T16:44:37.331166Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:36.833885Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.833885Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:2f8428f7fd8781248aa7e2faa55c1a9488f2cba0def3e85cf5a5770edf264fd9","observation_id":"d7f0b92b-6c5a-4521-8406-67beed504235","resolution":{"observed_at":"2026-08-15T16:44:36.833885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.01819","last_updated":"2025-08-21T22:02:14Z","snapshot_observed_at":"2026-08-15T03:50:46.755327Z","submitted_at":"2025-02-03T20:50:05Z","title":"Score as Action: Fine-Tuning Diffusion Generative Models by Continuous-time Reinforcement Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.01819","snapshot_observed_at":"2026-08-15T16:44:36.837980Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.837980Z"},"links":{"cited_paper":"/paper/2502.01819","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:46b86f1128415ca8cb61b82ca4f8325a5c0b1b569ce3358b0feafec483d92c92","observation_id":"6829bc90-f340-4ee5-89d3-ea9de10cd911","resolution":{"observed_at":"2026-08-15T16:44:36.837980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.312368Z","title":null,"venue":null,"work_id":"27153cbf-2abc-45d2-a15c-da4cd9403a16","year":2021},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.842390Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:64f2da6ebb88cb3a59fce139a448c7256ba3ea6fb42a6dfda55ad259503133e1","observation_id":"c10bce38-5728-4ab9-a8eb-f6c8654d5aad","resolution":{"observed_at":"2026-08-15T16:44:37.316649Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1909.08593","last_updated":"2020-01-08T23:02:36Z","snapshot_observed_at":"2026-08-16T00:15:57.597094Z","submitted_at":"2019-09-18T17:33:39Z","title":"Fine-Tuning Language Models from Human Preferences","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1909.08593","snapshot_observed_at":"2026-08-15T16:44:36.846633Z","title":null,"venue":null,"work_id":null,"year":1909},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.846633Z"},"links":{"cited_paper":"/paper/1909.08593","citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:ee8072e10b7eb55b46c6ff61aca51d24aca93ceb779e5eb7a70cf8f95166eeda","observation_id":"afce878f-7cf4-4d11-bce1-aaed7f9bd41e","resolution":{"observed_at":"2026-08-15T16:44:36.846633Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.298632Z","title":"Ziemann, S","venue":null,"work_id":"37f713c8-052c-416a-ac22-9ea069103bfb","year":2024},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.851181Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:ea130c720884d42f506e2f2c5f781a6d23623b885d0a0c5b33f9f04f20597607","observation_id":"e63fec42-085c-47d9-85ea-aa283a46723c","resolution":{"observed_at":"2026-08-15T16:44:37.302837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T16:44:37.284102Z","title":null,"venue":null,"work_id":"faa05cc0-3db2-41a8-84a6-be9a83ae55bf","year":2025},"citing_paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T16:44:36.855313Z"},"links":{"citing_paper":"/paper/2509.02528"},"observation_digest":"sha256:33bc23501bd7912e53d5e8dbc62cefa7667df8aedbe058977c86ccd989e6b24a","observation_id":"469d4b30-c38b-4926-bffb-249dc77554b5","resolution":{"observed_at":"2026-08-15T16:44:37.289119Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-16T06:30:59.297886+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.02528","last_updated":"2025-09-02T17:29:23Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-16T10:16:08.030860Z","submitted_at":"2025-09-02T17:29:23Z","title":"Is RL fine-tuning harder than regression? A PDE learning approach for diffusion models"},"reference_resolution":{"displayed":65,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":45,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":65},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-16T06:30:59.297886+00:00","source":"crossref"},{"observed_at":"2026-08-16T06:30:54.164669+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 65 of 65 outbound references and 0 inbound Pith citation observations for arXiv:2509.02528."}