{"as_of":"2026-08-11T13:21:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:32524b112b7ad7b2dcbcbb22fb4b9c91990e9bc9a39bb141610b3da24d296856","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T19:47:48.545820Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":4,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":4,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T20:38:28.328436Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T06:39:38.334217Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"cited_work":{"arxiv_id":"2510.21583","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.21583","snapshot_observed_at":"2026-07-04T06:39:38.334217Z","title":"Sample by step, optimize by chunk: Chunk-level grpo for text-to-image generation","venue":"cs.CV","work_id":"49d8201f-553a-4559-bc2b-55f3f8be3e31","year":2025},"citing_paper":{"arxiv_id":"2604.19406","last_updated":"2026-04-21T12:29:50Z","snapshot_observed_at":"2026-07-06T23:06:02.635464Z","submitted_at":"2026-04-21T12:29:50Z","title":"HP-Edit: A Human-Preference Post-Training Framework for Image Editing","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T03:26:15.525307Z"},"links":{"cited_paper":"/paper/2510.21583","citing_paper":"/paper/2604.19406"},"observation_digest":"sha256:ee56c05298b2f4d5168dfe8317e6770b3871254c26ecb329ed795d1f4aee5a5e","observation_id":"245acd5f-38ec-4881-b65f-4f557a80cd45","resolution":{"observed_at":"2026-05-21T02:04:53.918218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"cited_work":{"arxiv_id":"2510.21583","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.21583","snapshot_observed_at":"2026-07-04T06:39:38.334217Z","title":"Sample by step, optimize by chunk: Chunk-level grpo for text-to-image generation","venue":"cs.CV","work_id":"49d8201f-553a-4559-bc2b-55f3f8be3e31","year":2025},"citing_paper":{"arxiv_id":"2605.10937","last_updated":"2026-05-11T17:59:25Z","snapshot_observed_at":"2026-08-11T12:59:30.308378Z","submitted_at":"2026-05-11T17:59:25Z","title":"Power Reinforcement Post-Training of Text-to-Image Models with Super-Linear Advantage Shaping","version":1},"reference_index":101,"source":"pdf_text","source_observed_at":"2026-05-12T03:33:40.994346Z"},"links":{"cited_paper":"/paper/2510.21583","citing_paper":"/paper/2605.10937"},"observation_digest":"sha256:978e54e9b5b96663f86fc6a4259c3f304806aaf2226984e6bf3712544abf2deb","observation_id":"3be852d5-5e50-4965-9537-90c03b6a0132","resolution":{"observed_at":"2026-05-21T02:04:53.918218Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"cited_work":{"arxiv_id":"2510.21583","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.21583","snapshot_observed_at":"2026-07-04T06:39:38.334217Z","title":"Sample by step, optimize by chunk: Chunk-level grpo for text-to-image generation","venue":"cs.CV","work_id":"49d8201f-553a-4559-bc2b-55f3f8be3e31","year":2025},"citing_paper":{"arxiv_id":"2605.15190","last_updated":"2026-05-14T17:59:30Z","snapshot_observed_at":"2026-08-03T08:24:27.614764Z","submitted_at":"2026-05-14T17:59:30Z","title":"RAVEN: Real-time Autoregressive Video Extrapolation with Consistency-model GRPO","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-06-30T20:38:28.328436Z"},"links":{"cited_paper":"/paper/2510.21583","citing_paper":"/paper/2605.15190"},"observation_digest":"sha256:71d5f25186bef5fb6723ff92fc2db6da9bb32f26f28580d24f94fbb11cc78395","observation_id":"416e3438-4e53-4013-85f0-d1c8b83e3f3d","resolution":{"observed_at":"2026-07-01T14:35:47.194096Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"cited_work":{"arxiv_id":"2510.21583","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.21583","snapshot_observed_at":"2026-07-04T06:39:38.334217Z","title":"Sample by step, optimize by chunk: Chunk-level grpo for text-to-image generation","venue":"cs.CV","work_id":"49d8201f-553a-4559-bc2b-55f3f8be3e31","year":2025},"citing_paper":{"arxiv_id":"2606.21498","last_updated":"2026-06-19T14:50:22Z","snapshot_observed_at":"2026-08-06T22:06:36.715595Z","submitted_at":"2026-06-19T14:50:22Z","title":"Balancing Performance and Diversity in GRPO Autoregressive Text-to-Image Post-Training","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-26T14:14:45.547957Z"},"links":{"cited_paper":"/paper/2510.21583","citing_paper":"/paper/2606.21498"},"observation_digest":"sha256:cad9d3aa52d542cadd6fdd0199d44a0ec1f421755a859f9400864c0d6d12c1f9","observation_id":"abf3bc47-381f-44e8-8d90-401f9d2bbbf2","resolution":{"observed_at":"2026-07-04T06:39:38.335537Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2510.21583/citation-record","integrity":"/paper/2510.21583/integrity","json":"/paper/2510.21583/citation-record.json","paper":"/paper/2510.21583"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2410.24164","last_updated":"2026-01-08T17:01:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-31T17:22:30Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","version":4},"cited_work":{"arxiv_id":"2410.24164","doi":"10.48550/arxiv.2410.24164","metadata_source":"pith","pith_arxiv_id":"2410.24164","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi_0$: A Vision-Language-Action Flow Model for General Robot Control","venue":"cs.LG","work_id":"f790abdc-a796-482f-a40d-f8ee035ecfc2","year":2024},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2410.24164","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:e60c5b21e2cd03f8a0b9a7d02be024b781030f6b3cadf58f772735f84e9e4c1d","observation_id":"1498f7d0-76ab-40db-a34f-6b65a354e068","resolution":{"observed_at":"2026-05-21T19:50:33.854785Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:3789f5369cca66a6e697f16c7a7770acf3777df0b8cf785f340df05a475ef852","observation_id":"27003a4a-ebf9-49b7-8eff-585d8faee425","resolution":{"observed_at":"2026-05-21T19:50:33.864804Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.04324","last_updated":"2025-10-15T06:35:29Z","snapshot_observed_at":"2026-07-06T22:08:40.965707Z","submitted_at":"2025-08-06T11:10:39Z","title":"TempFlow-GRPO: When Timing Matters for GRPO in Flow Models","version":4},"cited_work":{"arxiv_id":"2508.04324","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.04324","snapshot_observed_at":"2026-07-09T03:05:55.312048Z","title":"TempFlow-GRPO: When Timing Matters for GRPO in Flow Models","venue":"cs.CV","work_id":"fecc731c-f8a2-4f00-ab1b-51b87a133726","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2508.04324","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:263e6ddf0d54151490a4aed5e7dcfda8619a1a5bd1ade57b7af4090be18a03e4","observation_id":"4a03c794-795c-4347-9dc4-4bcd9f75bf65","resolution":{"observed_at":"2026-05-21T21:52:31.656662Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.16054","last_updated":"2025-04-22T17:31:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-22T17:31:29Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","version":1},"cited_work":{"arxiv_id":"2504.16054","doi":"10.1609/aaai.v40i28.39562","metadata_source":"pith","pith_arxiv_id":"2504.16054","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"$\\pi_{0.5}$: a Vision-Language-Action Model with Open-World Generalization","venue":"cs.LG","work_id":"d1ad7304-d09a-49bc-809e-846439f6aff9","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2504.16054","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:58b41335372d9a1c701f7821ad0f7a10773bf811356ea93dbb8c20787f7a3887","observation_id":"2d19ea9a-fc35-4144-92dd-8c6d4e76cb84","resolution":{"observed_at":"2026-05-21T19:50:33.868682Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15742","last_updated":"2025-06-24T05:31:03Z","snapshot_observed_at":"2026-08-10T10:43:25.582099Z","submitted_at":"2025-06-17T20:18:23Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","version":2},"cited_work":{"arxiv_id":"2506.15742","doi":"10.48550/arxiv.2506.15742","metadata_source":"pith","pith_arxiv_id":"2506.15742","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space","venue":"cs.GR","work_id":"5dfe19d5-3541-4803-8fe9-3c8b9e29b281","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2506.15742","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:debf2bf8f88fb1fcda242a072a6fcc07620125202e7e6b3476a4a3c129fe99c3","observation_id":"fc55de41-fc45-41ee-aaea-bc17659fc0b9","resolution":{"observed_at":"2026-05-21T19:50:33.858347Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:20.581238+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.21802","last_updated":"2026-03-20T17:20:12Z","snapshot_observed_at":"2026-08-01T16:12:11.335962Z","submitted_at":"2025-07-29T13:40:09Z","title":"MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE","version":6},"cited_work":{"arxiv_id":"2507.21802","doi":null,"metadata_source":"pith","pith_arxiv_id":"2507.21802","snapshot_observed_at":"2026-07-09T03:05:55.323624Z","title":"MixGRPO: Unlocking Flow-based GRPO Efficiency with Mixed ODE-SDE","venue":"cs.AI","work_id":"8b0ab84a-b7ea-46ea-a6ba-bf490a84d251","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2507.21802","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:70a6d8d3abcce4bb58160494c5cd90c17c062786a62bf6334b3cc1037a0f080e","observation_id":"a334ff87-f36a-48ed-88b5-8e58dd71a754","resolution":{"observed_at":"2026-05-21T19:50:33.861376Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.05470","last_updated":"2025-10-27T09:57:02Z","snapshot_observed_at":"2026-08-06T11:11:00.378627Z","submitted_at":"2025-05-08T17:58:45Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","version":5},"cited_work":{"arxiv_id":"2505.05470","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.05470","snapshot_observed_at":"2026-07-09T02:25:55.898592Z","title":"Flow-GRPO: Training Flow Matching Models via Online RL","venue":"cs.CV","work_id":"bf1e8e81-ff31-401a-a5dc-d9c49df168ab","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2505.05470","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:51e7013d94f2e3ff52d7b1471341afb55e9aaeaac86844556e85cc813edf5fb4","observation_id":"1df560dc-494d-4e6d-91f2-299a60fda3f0","resolution":{"observed_at":"2026-05-21T19:50:33.803085Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.03789","last_updated":"2025-08-22T08:53:37Z","snapshot_observed_at":"2026-08-07T20:35:27.515637Z","submitted_at":"2025-08-05T17:17:13Z","title":"HPSv3: Towards Wide-Spectrum Human Preference Score","version":2},"cited_work":{"arxiv_id":"2508.03789","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2508.03789","snapshot_observed_at":"2026-07-04T13:29:50.921149Z","title":"Hpsv3: Towards wide-spectrum human preference score.arXiv preprint arXiv:2508.03789","venue":null,"work_id":"07750820-6650-4ada-bb72-56cbca3871f6","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2508.03789","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:07b208d44664f2d8635b7dd9ee1306822f8a9dd4d66dbd2ec850430778799fad","observation_id":"2677e3f0-2f34-4f8a-ba04-f4c16eed30f8","resolution":{"observed_at":"2026-05-21T19:50:33.819081Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07265","last_updated":"2026-06-02T17:11:50Z","snapshot_observed_at":"2026-08-07T17:17:00.060047Z","submitted_at":"2025-03-10T12:47:53Z","title":"WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation","version":4},"cited_work":{"arxiv_id":"2503.07265","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.07265","snapshot_observed_at":"2026-07-04T13:19:50.710913Z","title":"WISE: A World Knowledge-Informed Semantic Evaluation for Text-to-Image Generation","venue":"cs.CV","work_id":"604c1ae0-368d-49bf-8117-d688ac59f305","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2503.07265","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:678c452d21b593cb05ed6b692a07b74ed005a729109994efcf8ecf685b4f3aa0","observation_id":"1265ee82-1043-4370-9bce-1c21f002e641","resolution":{"observed_at":"2026-05-21T19:50:33.846959Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:f57ae77098ef53954fa27daed6554c079fc09597b2f19cfc79f55f6e5874c27a","observation_id":"5cf6a0ac-d990-47de-b3cb-753b6f1aea9d","resolution":{"observed_at":"2026-05-21T19:50:33.843772Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:620e5b140d723822b94a4d1800b6261fa64e2486e82a17f6a78ce77f28c8c6b7","observation_id":"24cb4f52-dabc-44c7-929f-868e2f7e2cde","resolution":{"observed_at":"2026-05-21T19:50:33.872470Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.01844","last_updated":"2025-06-02T16:30:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-02T16:30:19Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","version":1},"cited_work":{"arxiv_id":"2506.01844","doi":"10.48550/arxiv.2506.01844","metadata_source":"pith","pith_arxiv_id":"2506.01844","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SmolVLA: A Vision-Language-Action Model for Affordable and Efficient Robotics","venue":"cs.LG","work_id":"0c5e9314-5fa7-4613-ad12-605a71d561d2","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2506.01844","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:b65740a22b4cb893275aa3cecaa18e1c5fec62aaba37d0da02e5b0984796b6b4","observation_id":"dd645fd4-0f70-4601-a2e1-c52f3e27111f","resolution":{"observed_at":"2026-05-21T19:50:33.836808Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.18536","last_updated":"2025-05-24T06:01:48Z","snapshot_observed_at":"2026-08-07T22:01:21.366221Z","submitted_at":"2025-05-24T06:01:48Z","title":"Reinforcement Fine-Tuning Powers Reasoning Capability of Multimodal Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.18536","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.18536","snapshot_observed_at":"2026-07-04T19:50:10.284267Z","title":"Reinforcement fine-tuning powers reasoning ca- pability of multimodal large language models","venue":null,"work_id":"59c7639b-064a-4052-a6a0-5504a24d72d6","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2505.18536","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:f2c4b6667b2fb65a7a522940a83c58bd135f70bd6bd1f479fa524fbd91f894d1","observation_id":"9161386b-c4f9-478d-afcf-2bc15d5c4f0c","resolution":{"observed_at":"2026-05-21T19:50:33.810618Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.05952","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:05:55.300508Z","title":"Coefficients-preserving sampling for reinforcement learning with flow matching.arXiv preprint arXiv:2509.05952","venue":null,"work_id":"3bc58f2f-e4be-4ee5-804f-29ffd6dfdb30","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:456015532ac2a948e84925b4375786d1d87c8c8061e4a2c1548ff7a9b5619c4e","observation_id":"30aa5399-ec83-4c02-9f71-e3ac89260494","resolution":{"observed_at":"2026-05-21T19:50:33.833248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.20751","last_updated":"2026-04-20T06:12:09Z","snapshot_observed_at":"2026-08-10T13:14:59.112811Z","submitted_at":"2025-08-28T13:11:24Z","title":"Pref-GRPO: Pairwise Preference Reward-based GRPO for Stable Text-to-Image Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2508.20751","doi":null,"metadata_source":"pith","pith_arxiv_id":"2508.20751","snapshot_observed_at":"2026-07-04T13:29:50.929884Z","title":"Pref-GRPO: Pairwise Preference Reward-based GRPO for Stable Text-to-Image Reinforcement Learning","venue":"cs.CV","work_id":"2e956374-b453-4e32-bfd8-55ee95a85a55","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2508.20751","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:66ba95df1768f5251283def65100ff92e5b0858e71eb83a2fb5f49aa02060772","observation_id":"767d40ab-f748-4528-9391-6c07f5686b69","resolution":{"observed_at":"2026-05-21T19:50:33.840331Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":"2508.02324","doi":"10.48550/arxiv.2508.02324","metadata_source":"pith","pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen-Image Technical Report","venue":"cs.CV","work_id":"d06d7ecc-7579-4f89-a60b-4278a0f3c562","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:916e47004c77d5beb5ee9ba5692960af4673fd964ec7bf1018ccc68e2e073e18","observation_id":"84c58d68-1553-4fc8-be1f-25082105195e","resolution":{"observed_at":"2026-05-21T19:50:33.822100Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-21T15:23:05.016381+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.09341","last_updated":"2023-09-25T08:19:23Z","snapshot_observed_at":"2026-08-11T00:30:13.593181Z","submitted_at":"2023-06-15T17:59:31Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2306.09341","doi":"10.48550/arxiv.2306.09341","metadata_source":"pith","pith_arxiv_id":"2306.09341","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Human Preference Score v2: A Solid Benchmark for Evaluating Human Preferences of Text-to-Image Synthesis","venue":"cs.CV","work_id":"40702548-f094-4c67-a5db-a62f426f852e","year":2023},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2306.09341","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:4bd79f836958af832b8f9fe8ac1ca526fae885fa69380e542ff2bd3ffdcb6623","observation_id":"e86476be-345b-4391-96ca-9f607b5a9488","resolution":{"observed_at":"2026-05-21T19:50:33.829300Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07818","last_updated":"2025-08-28T17:19:45Z","snapshot_observed_at":"2026-08-10T06:20:33.458844Z","submitted_at":"2025-05-12T17:59:34Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","version":4},"cited_work":{"arxiv_id":"2505.07818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.07818","snapshot_observed_at":"2026-07-09T03:05:55.316091Z","title":"DanceGRPO: Unleashing GRPO on Visual Generation","venue":"cs.CV","work_id":"7404dd36-8f9c-478f-b089-ef9f8189c711","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2505.07818","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:f3e6b11b868f655c30396c0d682babef99eadc75160105a3d4bc16095a8cccad","observation_id":"681582c1-61a5-474e-840c-bc1aad5d9923","resolution":{"observed_at":"2026-05-21T19:50:33.806287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.13705","last_updated":"2023-04-23T19:10:53Z","snapshot_observed_at":"2026-08-03T01:22:01.078078Z","submitted_at":"2023-04-23T19:10:53Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","version":1},"cited_work":{"arxiv_id":"2304.13705","doi":"10.48550/arxiv.2304.13705","metadata_source":"pith","pith_arxiv_id":"2304.13705","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Learning Fine-Grained Bimanual Manipulation with Low-Cost Hardware","venue":"cs.RO","work_id":"6fe159e0-fa73-481a-88d4-4719c15140be","year":2023},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2304.13705","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:de44f3d8a2647307d7b4dbe9c178008be2834a39e7f94e46267d2f94b8b60004","observation_id":"d40b59ed-b513-4e56-957b-0574b8368374","resolution":{"observed_at":"2026-05-21T19:50:33.851348Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.18071","last_updated":"2025-07-28T11:11:33Z","snapshot_observed_at":"2026-08-06T04:31:03.113409Z","submitted_at":"2025-07-24T03:50:32Z","title":"Group Sequence Policy Optimization","version":2},"cited_work":{"arxiv_id":"2507.18071","doi":"10.48550/arxiv.2507.18071","metadata_source":"pith","pith_arxiv_id":"2507.18071","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Group Sequence Policy Optimization","venue":"cs.LG","work_id":"3a98b53b-9f52-4d95-adf7-89353c0a9a65","year":2025},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"cited_paper":"/paper/2507.18071","citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:235ce304c43761d29e726cddce4ee3977a6e0baa2a6f5805d831f00f8c45c640","observation_id":"cf2a5567-0ec2-4da8-81ab-b5f980e92265","resolution":{"observed_at":"2026-05-21T19:50:33.825525Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c9a10542-2232-4d97-9efe-7b1ca5c9cab8","year":2015},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:37d76f57328d7b021ecfbe9ad8ba23666e013f4ae3df886639ba5ecdb30a4bcd","observation_id":"2083c3d1-4b32-4c3c-afba-ec9404300a98","resolution":{"observed_at":"2026-05-21T19:50:34.567791Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"(2015; 2017)","venue":null,"work_id":"8cb46e3d-b754-4231-b711-442c0ac4c30b","year":2015},"citing_paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-21T19:47:48.545820Z"},"links":{"citing_paper":"/paper/2510.21583"},"observation_digest":"sha256:4a52bfe77fd522faaf384cb070034f105c32660740dcc864fe7a7f64715108af","observation_id":"765f4c4f-1728-4acf-8fdc-ecbd5668cff3","resolution":{"observed_at":"2026-05-21T19:50:34.565627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2510.21583","last_updated":"2026-05-20T09:16:04Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:33:58.663508Z","submitted_at":"2025-10-24T15:50:36Z","title":"Principled RL for Flow Matching Emerges from the Chunk-level Policy Optimization"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":1,"verified_exact":16,"verified_fuzzy":1},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 4 inbound Pith citation observations for arXiv:2510.21583."}