{"as_of":"2026-08-08T16:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4376cb71f1d0c97bbc77b963b43c07e516ecec6066b1e26278893cfe1bee4ecf","coverage":[{"denominator":31,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":31,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T18:15:37.117367Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.24001/citation-record","integrity":"/paper/2605.24001/integrity","json":"/paper/2605.24001/citation-record.json","paper":"/paper/2605.24001"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.184025Z","title":"𝑠ref istrainedfor10,000stepsviaDSMonsamplesfrom 𝑞0 (Adam,lr=3 ×10−4, batch 2,048)","venue":null,"work_id":"b1a4bb18-3b99-49e5-b7fc-e2d669479478","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:44c60ade77d4d2438afac1c98a556beccc5f192769195e5b304a4a7d11d60f36","observation_id":"6a14986b-f2ae-4bca-925c-3ab731aaec60","resolution":{"observed_at":"2026-07-08T05:44:36.185784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.218842Z","title":"𝑔𝜃 is initialised by regressing against 30-step DDIM samples from𝑠ref using matched noise (3,000 steps, Adam, lr=10−3, batch 2,048)","venue":null,"work_id":"c41c5b16-c59c-4365-83e3-4e9611e944b6","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:d2801416340993939a21a298fb35bf5cc589e52e4f5ac88ef0dadeecd21d7e41","observation_id":"38e7a0cd-7c1a-4a70-adbb-5e86383272f5","resolution":{"observed_at":"2026-07-08T05:44:36.220256Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.230494Z","title":"The two methods differ only in𝑠target: Method Reward location DI++ endpoint𝑥 0 only Didrevery noise level via DRS Evaluation","venue":null,"work_id":"83bf6af3-c5f0-4ce7-9e9d-1250937f8df8","year":2023},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:648d7d0ad5817c4a0e187e486f7c3ea8afc529825c4e820b8b4fb0eeb1fda4a6","observation_id":"e7b2232c-b405-4adf-b569-0f0d3eaebea4","resolution":{"observed_at":"2026-07-08T05:44:36.231862Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2200.1100","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T15:05:47.839636Z","title":"Text-alignment metrics","venue":null,"work_id":"4dfc247c-148c-43d5-83fa-e90efefe4f5f","year":2021},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:5df27715106fd1438eba2f0f3c7933255d929ca836c661e9951722c6261dfc80","observation_id":"fc8499f2-4ddd-4aa2-b7a7-b134866d8320","resolution":{"observed_at":"2026-07-01T15:05:47.840970Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.196297Z","title":null,"venue":null,"work_id":"bb7406bf-f183-4abc-9a75-a27bdad02f34","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:533aa35e29c7d2d8308039f76e776c97234db8477278d7f10b6ea9e18d73f97a","observation_id":"ff794f6e-5fef-48a0-a67b-dd8a59f92cc7","resolution":{"observed_at":"2026-07-08T05:44:36.197485Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.194219Z","title":null,"venue":null,"work_id":"366a201a-eb3c-4e15-b1d8-9f3e183e3056","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:bf4cb459cc714bde7b39731370599911d946bd24f424085b101aa3c7b6f072d2","observation_id":"c1aee23b-4616-49b5-a416-6c590e30f3df","resolution":{"observed_at":"2026-07-08T05:44:36.195594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.181484Z","title":null,"venue":null,"work_id":"9c8d723d-1e68-4a51-a781-fa08ce92df74","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:85ad078ab309c1d5f68c001399827ae5cbf7e29c72ac486a904687a13192784d","observation_id":"9151d766-81da-43c6-919b-d1ad970c5e5c","resolution":{"observed_at":"2026-07-08T05:44:36.183279Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.203366Z","title":null,"venue":null,"work_id":"bb3a0864-a4e1-4ce8-a8dc-e3fa723441e4","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:86d3a3103852cb5e3dc85f152a70259f557a60b497ee7dff1e32ad84a15b658d","observation_id":"0f093dba-6701-434d-b8ef-2a9b853a52d8","resolution":{"observed_at":"2026-07-08T05:44:36.204438Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.201730Z","title":null,"venue":null,"work_id":"d5e48154-ea6a-4554-9453-7bd9b2c7951b","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:95d18a1ed4b1f728fddc4ff1eea716d61db20d36c71ffadd3565f89952c8dad5","observation_id":"fdafc603-26aa-4f83-819b-0a6c23b7a2b5","resolution":{"observed_at":"2026-07-08T05:44:36.202790Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.204983Z","title":null,"venue":null,"work_id":"84fc9a54-ecaa-469c-90a8-dcd3f5861845","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:5484fcc05cb2597a138731bc99c4e07ed73c9cd697b7a1448b7c5f74e25c4ec2","observation_id":"eaae68d9-4155-42ac-95d9-cc5a06ed4848","resolution":{"observed_at":"2026-07-08T05:44:36.206079Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.228561Z","title":null,"venue":null,"work_id":"9703cd38-4a9c-4a3b-8045-25faacba22db","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:0bfcabf718dd42fac55099390e2197f93a6f106dfca650993d6afa14f892211d","observation_id":"72eb4696-cc1b-4fac-85f1-cd92c3c51b80","resolution":{"observed_at":"2026-07-08T05:44:36.229614Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.224912Z","title":null,"venue":null,"work_id":"96f38a86-ffab-4ace-9f3d-4c3d44ef0448","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:0666179f2c8133f5986ef67bae02127e4256843aa2d3e9edc19ee62e2e4973bf","observation_id":"ec7c13c3-76dd-4f79-9fbb-75356cbbce01","resolution":{"observed_at":"2026-07-08T05:44:36.226126Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.232435Z","title":null,"venue":null,"work_id":"a74df921-a8b6-4f6a-a6d2-8230e9b5aff3","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:623b5997fe969019217d2a1bd923aa2bc801bc7f0862e9e8604ffd49a0684c10","observation_id":"52d39989-41b4-4fb5-a857-00f78278a216","resolution":{"observed_at":"2026-07-08T05:44:36.233501Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.186419Z","title":null,"venue":null,"work_id":"db710637-809b-45ac-b90e-67a76954c961","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:0c2e0c4053a62b97ba8aa1569849a83a37516916ea78f516b185db60bcaa2342","observation_id":"c447fbfe-36f9-4d9c-bd30-b68578bb77cf","resolution":{"observed_at":"2026-07-08T05:44:36.187680Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.222876Z","title":null,"venue":null,"work_id":"7855aea7-4c9c-4808-8846-2bad6813e8c7","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:340ac01b2342c86e454dd4a8a947a15859d14fe572a5265d2395b4c59f564c94","observation_id":"af10cf5e-809b-44bc-a2b1-da113752f1e9","resolution":{"observed_at":"2026-07-08T05:44:36.224294Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.208647Z","title":"Z-Image comparison:","venue":null,"work_id":"4a9e33ff-e749-4695-b588-8c84a7281125","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:912623e192127ca94996c3514fba516e727b0c9b585f601d485383fc3ad7e5a3","observation_id":"d4b98ebe-d4a1-493c-b642-12c3454e2ce0","resolution":{"observed_at":"2026-07-08T05:44:36.209867Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.198137Z","title":null,"venue":null,"work_id":"bb6e73ed-3311-411c-8c89-3e73a3677616","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:048ca0cead2313fcc82bcff1187ac1df376411edfdc04914e538aa3d5fb10df8","observation_id":"f97f2b6c-b682-4796-b2bb-66fa9c74f36d","resolution":{"observed_at":"2026-07-08T05:44:36.199340Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.190155Z","title":null,"venue":null,"work_id":"f52f7b6c-aecf-4e8e-b5f6-1666d4bc1679","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:aa98ce48375731cf49aa08943a4d642fdee0e32889f0fc2828af6bfe4deb24a8","observation_id":"f57d6081-c72b-421b-bcdd-6048b44bcd3f","resolution":{"observed_at":"2026-07-08T05:44:36.191364Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.234025Z","title":"Figure 7 — Temperature Ablation","venue":null,"work_id":"4dc7822d-8a2c-4f2c-97b2-4413eef133a1","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:60e5816349cb0394f1671bbb88629efd89c41a268d3f4ceb26aa85bc85d8faa1","observation_id":"cbc051a9-74f4-42cf-9cb5-8480684b8e20","resolution":{"observed_at":"2026-07-08T05:44:36.235070Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.188368Z","title":null,"venue":null,"work_id":"1d31a7dd-d3b8-4b0f-be98-2b0d0a93c45d","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:71c7d976fd82649a517dc2f4eaa7e92b8c46c595436e3eda42d228733918b482","observation_id":"af58d504-459e-4201-99a0-a1454d4d8175","resolution":{"observed_at":"2026-07-08T05:44:36.189590Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.192091Z","title":null,"venue":null,"work_id":"2eb8ba42-dfde-46c2-8c2c-2226088b4790","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:5d1537a5049ea79c531fd48042f10e1a15040df678904d2698b36060f3d7a4a8","observation_id":"931b2666-3d21-49a1-9971-40f7086683be","resolution":{"observed_at":"2026-07-08T05:44:36.193502Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.220940Z","title":null,"venue":null,"work_id":"380a0427-8c04-4195-9e76-dad8e5155060","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:d1a5adc63442d7ef228fbe60d8efddeea305af2648b3fdf207c29c8b97a257e8","observation_id":"a40b9974-a0ef-4574-9032-dbdca23c1dc6","resolution":{"observed_at":"2026-07-08T05:44:36.222157Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.226664Z","title":null,"venue":null,"work_id":"455e4665-7dcd-4853-be61-9485d0351ae1","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:5deb6f487f5709b87ca82093065b6456d527cd3cf1490e1ced5529c181b77672","observation_id":"df0f3877-57af-491e-9f71-cb68d8fd67b4","resolution":{"observed_at":"2026-07-08T05:44:36.227771Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.199936Z","title":null,"venue":null,"work_id":"3170f22e-07ac-4d4a-b084-1f09560be9ba","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:adb68bf7b84a384b2447f3fc8b6316987179c4830da60f5ebba1e92a714dff5d","observation_id":"a43e705f-1dd5-4704-9a11-508b0c4211c7","resolution":{"observed_at":"2026-07-08T05:44:36.201181Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.214823Z","title":null,"venue":null,"work_id":"87e7bc54-c747-4be6-9e32-738d4e9de753","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:a199489c75abe5d59fe71bb52d4fc5b522795e08e4f6a3419c8b861388009cdc","observation_id":"0b25ffdf-f042-4e45-be16-80f16c2d8b35","resolution":{"observed_at":"2026-07-08T05:44:36.216448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.206666Z","title":null,"venue":null,"work_id":"4acf1b1e-d4e7-4344-8079-f1722b0a60b8","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:1501caa456df10a397812a89e11729f3c922cf7ec26006a9bcf33222c7a5f614","observation_id":"e87af3ff-6a48-4436-9a0b-f1afb78e5d61","resolution":{"observed_at":"2026-07-08T05:44:36.207938Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.217101Z","title":null,"venue":null,"work_id":"cf78172e-8432-407f-a291-5e39ecae5bd5","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:3c775a35d970b76636dc95acbc64c621b68b339aecc563acdbecc5d51cb3b334","observation_id":"188c89b6-81ae-449a-9507-bb95e8fd4799","resolution":{"observed_at":"2026-07-08T05:44:36.218251Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.179175Z","title":null,"venue":null,"work_id":"fc43de64-9779-4766-b5df-a3d73e9b137e","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:18507f2d32e51f610d5e1a686a31dd2d21cdfce05ce118fdf7bbd97e1182dc49","observation_id":"99ba93af-1204-4f85-a7de-c96318e8a56c","resolution":{"observed_at":"2026-07-08T05:44:36.180717Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.212804Z","title":null,"venue":null,"work_id":"ada40040-3323-45d7-9f9c-2d8606c0d3be","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:b87d16edacf2830f6c4a16385d240cb636c9e8e0d7ef01eaaf671fcf8ba67160","observation_id":"b333dd30-6e9a-435a-ad45-a2915617e52f","resolution":{"observed_at":"2026-07-08T05:44:36.214138Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.210646Z","title":null,"venue":null,"work_id":"d30944e7-e7a0-4ba4-803f-21561e23c549","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:6906b2668a3acccd03b201fcbe0de7191c378e82003cda50eb20776b2eaab4d9","observation_id":"2005f284-ffd8-46ab-9034-6306454c3ea1","resolution":{"observed_at":"2026-07-08T05:44:36.211884Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T05:44:36.235609Z","title":null,"venue":null,"work_id":"12ad3397-0abb-4d4b-a323-2e39c1543d76","year":null},"citing_paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T18:15:37.117367Z"},"links":{"citing_paper":"/paper/2605.24001"},"observation_digest":"sha256:3186049949d212b033a5db7a5507c24cd4cf7bc3eb40659beabafd5a00b1334c","observation_id":"02bbcc04-bf46-4018-bf15-be88a9ae769c","resolution":{"observed_at":"2026-07-08T05:44:36.236675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.24001","last_updated":"2026-05-26T04:35:31Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:34:08.786038Z","submitted_at":"2026-05-18T21:26:33Z","title":"Diff-Instruct with Diffused Reward: Towards Principled One-step Generator RL"},"reference_resolution":{"displayed":31,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":5},"total_outbound_references":31},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 31 of 31 outbound references and 0 inbound Pith citation observations for arXiv:2605.24001."}