{"as_of":"2026-08-07T19:34:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:abe4ee2c289f1a0e3b5d044698f7a43b10c3db154ffb68aae962d1e1693a1722","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":17,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":17,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":17,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":17,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-04T18:48:03.631140Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-04T16:39:58.241853Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2509.02547","last_updated":"2026-04-17T18:09:08Z","snapshot_observed_at":"2026-08-03T09:07:42.489237Z","submitted_at":"2025-09-02T17:46:26Z","title":"The Landscape of Agentic Reinforcement Learning for LLMs: A Survey","version":5},"reference_index":258,"source":"pdf_text","source_observed_at":"2026-05-18T19:19:36.427337Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2509.02547"},"observation_digest":"sha256:7cf71221b85b4ba4e27fcd81e94dee2d6b20cee883787a54a7de1587f7ca94ef","observation_id":"1a05092a-b4a2-4775-b79c-f58b6f9084fc","resolution":{"observed_at":"2026-05-18T19:21:48.230655Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2509.08827","last_updated":"2025-10-09T17:08:52Z","snapshot_observed_at":"2026-08-06T15:38:05.011922Z","submitted_at":"2025-09-10T17:59:43Z","title":"A Survey of Reinforcement Learning for Large Reasoning Models","version":3},"reference_index":122,"source":"arxiv_source","source_observed_at":"2026-05-18T00:02:24.352947Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2509.08827"},"observation_digest":"sha256:d9806ad638156c916fe0cf01a1a4c1bf050ecf21f5a8eac9bff76fddcad225ec","observation_id":"937a204b-cf09-4159-8f3d-86a1fac5637c","resolution":{"observed_at":"2026-05-18T00:02:25.313296Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-08-04T18:48:03.631140Z","title":"Got-r1: Unleashing reasoning capability of mllm for visual generation with reinforcement learning.arXiv preprint arXiv:2505.17022, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.09680","last_updated":"2025-09-11T17:59:59Z","snapshot_observed_at":"2026-08-04T18:48:02.197558Z","submitted_at":"2025-09-11T17:59:59Z","title":"FLUX-Reason-6M & PRISM-Bench: A Million-Scale Text-to-Image Reasoning Dataset and Comprehensive Benchmark","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-04T18:48:03.631140Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2509.09680"},"observation_digest":"sha256:44493710243f933e499d1e959185137c1322603dbbb599e29bb9bd6fca450f0c","observation_id":"5aa4c4a5-d4bd-4dba-a56a-700e5605e989","resolution":{"observed_at":"2026-08-04T18:48:03.631140Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-08-04T09:54:24.184568Z","title":"Got-r1: Unleashing reasoning capability of mllm for visual generation with reinforcement learning.arXiv preprint arXiv:2505.17022,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2510.12784","last_updated":"2026-06-28T11:09:54Z","snapshot_observed_at":"2026-08-04T09:54:23.338683Z","submitted_at":"2025-10-14T17:56:11Z","title":"SRUM: Fine-Grained Self-Rewarding for Unified Multimodal Models","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-04T09:54:24.184568Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2510.12784"},"observation_digest":"sha256:081c1d3a186452939044ccf54edbdced375d1ac3bd2ec67c31300ecb2f4702fc","observation_id":"caa6bf72-8cd2-47eb-9a59-4c222b40aa02","resolution":{"observed_at":"2026-08-04T09:54:24.184568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2512.01236","last_updated":"2026-04-09T08:04:17Z","snapshot_observed_at":"2026-08-02T07:28:05.240599Z","submitted_at":"2025-12-01T03:25:49Z","title":"PSR: Scaling Multi-Subject Personalized Image Generation with Pairwise Subject-Consistency Rewards","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-17T03:49:05.489626Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2512.01236"},"observation_digest":"sha256:22b781c4ddf40cb51ea485db36d63d82cb59e2c32ed43d0993f8682ec2eab60e","observation_id":"00b19032-37ed-41a1-916d-f871d6cedbff","resolution":{"observed_at":"2026-05-17T03:51:29.372261Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-13T23:27:11.006580Z","title":"arXiv preprint arXiv:2505.17022 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16870","last_updated":"2026-07-31T08:55:01Z","snapshot_observed_at":"2026-08-05T23:10:24.488750Z","submitted_at":"2026-03-17T17:59:55Z","title":"Demystifying Video Reasoning","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-13T23:27:11.006580Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2603.16870"},"observation_digest":"sha256:2583e24cb03a988e36bf1e64e78046dde2ae716459cd606e24d6a052e62de726","observation_id":"db44c475-71a3-401b-b341-fb815a499ceb","resolution":{"observed_at":"2026-07-13T23:27:11.006580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-08-03T02:33:53.733424Z","title":"arXiv preprint arXiv:2505.17022 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2603.16870","last_updated":"2026-07-31T08:55:01Z","snapshot_observed_at":"2026-08-05T23:10:24.488750Z","submitted_at":"2026-03-17T17:59:55Z","title":"Demystifying Video Reasoning","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T02:33:53.733424Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2603.16870"},"observation_digest":"sha256:885f7e6140afafeacc9973f457db5ed043f6b4bfac298f95e58828e22633fce4","observation_id":"516faf33-70ee-4909-9683-b156ffc9db19","resolution":{"observed_at":"2026-08-03T02:33:53.733424Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2604.04500","last_updated":"2026-04-06T07:51:59Z","snapshot_observed_at":"2026-07-30T06:32:02.248567Z","submitted_at":"2026-04-06T07:51:59Z","title":"Saliency-R1: Enforcing Interpretable and Faithful Vision-language Reasoning via Saliency-map Alignment Reward","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T19:59:19.379119Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2604.04500"},"observation_digest":"sha256:8b908ca15d4e788d6e87b5894c57dbbb25546fd37d94a8a18d4a84874b825dc2","observation_id":"6dac6061-0d13-46e9-829c-c94867eeecdb","resolution":{"observed_at":"2026-05-10T22:20:47.844523Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2604.24625","last_updated":"2026-04-27T15:52:48Z","snapshot_observed_at":"2026-07-06T23:10:38.548416Z","submitted_at":"2026-04-27T15:52:48Z","title":"Meta-CoT: Enhancing Granularity and Generalization in Image Editing","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-08T04:30:28.636915Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2604.24625"},"observation_digest":"sha256:c49ebc4533a15c72fe3af241fa152e22766a60d444ab51bc51f39a0ac89976d9","observation_id":"e500cf13-84a6-4c94-95e4-5c45e0173aef","resolution":{"observed_at":"2026-05-11T21:46:13.279370Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-13T07:21:40.803291Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:4652c14288fc2cb178183afa402927a10eb7fb16be8032788faba5bf11fcc9a9","observation_id":"1ee22c8d-8ecd-48d3-a3ee-db5e6837eedf","resolution":{"observed_at":"2026-05-13T07:22:28.450807Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-19T16:48:20.132240Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:0625d744d86bd3977de8ae45ea342f37e6b5f681313183e233afa7ebe240a12b","observation_id":"edd9b6e7-bb74-4838-8f0c-001b6a967dac","resolution":{"observed_at":"2026-05-19T16:52:40.185513Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2605.12374","last_updated":"2026-05-25T11:34:51Z","snapshot_observed_at":"2026-08-05T07:57:54.689541Z","submitted_at":"2026-05-12T16:41:09Z","title":"Fill the GAP: A Granular Alignment Paradigm for Visual Reasoning in Multimodal Large Language Models","version":3},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-21T08:02:00.980836Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2605.12374"},"observation_digest":"sha256:41463702e2ff67228ab52515efcc90049f77f8ca1bcd9f60fdecf4547d163d8d","observation_id":"1dea298d-778d-4428-9fad-dbbc972204a5","resolution":{"observed_at":"2026-05-21T08:04:02.662823Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2605.23500","last_updated":"2026-06-01T11:20:54Z","snapshot_observed_at":"2026-08-01T15:40:53.796804Z","submitted_at":"2026-05-22T11:04:12Z","title":"B-GRTO: Bootstrapped Group Relative Tool Optimization for Referring Segmentation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-25T04:27:15.911342Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2605.23500"},"observation_digest":"sha256:485a447b01a04d0c96133f287e2062e5ea1a4cec2fdd3afef4be785f1229f335","observation_id":"f32ca364-43fe-47c5-a928-79787bb578e5","resolution":{"observed_at":"2026-05-25T04:30:20.645237Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2605.23500","last_updated":"2026-06-01T11:20:54Z","snapshot_observed_at":"2026-08-01T15:40:53.796804Z","submitted_at":"2026-05-22T11:04:12Z","title":"B-GRTO: Bootstrapped Group Relative Tool Optimization for Referring Segmentation","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-30T16:00:40.812912Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2605.23500"},"observation_digest":"sha256:b1e24872635f2a09c6adf66577175db3c9ab166456fb65b93c4f45818f8fcfd1","observation_id":"fd3c0cd2-1340-47a9-b03a-cc0eb5118814","resolution":{"observed_at":"2026-06-30T16:04:52.997914Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2606.04046","last_updated":"2026-06-02T07:50:56Z","snapshot_observed_at":"2026-08-06T11:17:23.952215Z","submitted_at":"2026-06-02T07:50:56Z","title":"Dive into the Scene: Breaking the Perceptual Bottleneck in Vision-Language Decision Making via Focus Plan Generation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-28T10:28:41.952330Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2606.04046"},"observation_digest":"sha256:6a544528fc3d7823cb0be0925a1f2de36bbc497bea17a47dfaada0fce72817af","observation_id":"5e4a12c1-dc9f-4802-a659-453f0c34ffe7","resolution":{"observed_at":"2026-07-02T02:56:29.293936Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2606.04264","last_updated":"2026-06-02T22:30:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-06-02T22:30:46Z","title":"UniCanvas: A Diffusion-base Unified Model for Text-in-Image Joint Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T10:23:43.501656Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2606.04264"},"observation_digest":"sha256:5298addc3510fe91cd48374e5d596192d17b213d66959adb3ee5003f65a24c2d","observation_id":"47ed9e8d-6ae9-486a-b062-8ba11c7620fc","resolution":{"observed_at":"2026-07-02T03:06:29.575568Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2505.17022","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.17022","snapshot_observed_at":"2026-07-04T16:39:58.241853Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning","venue":"cs.CV","work_id":"b2fba730-5ab1-403b-aa1f-8dffe2424629","year":2025},"citing_paper":{"arxiv_id":"2606.24849","last_updated":"2026-06-23T17:28:00Z","snapshot_observed_at":"2026-08-03T11:30:36.402988Z","submitted_at":"2026-06-23T17:28:00Z","title":"IV-CoT: Implicit Visual Chain-of-Thought for Structure-Aware Text-to-Image Generation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-26T00:19:49.071495Z"},"links":{"cited_paper":"/paper/2505.17022","citing_paper":"/paper/2606.24849"},"observation_digest":"sha256:0083122c0e75a97607385ef1cf9ed08adf702bf4c2287ca12d99140d8fc5225f","observation_id":"d572bf79-1550-4926-aa5b-4abc6e3c5429","resolution":{"observed_at":"2026-07-04T16:39:58.243105Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2505.17022/citation-record","integrity":"/paper/2505.17022/integrity","json":"/paper/2505.17022/citation-record.json","paper":"/paper/2505.17022"},"outbound":[],"paper":{"arxiv_id":"2505.17022","last_updated":"2026-04-12T04:05:04Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T21:28:43.610849Z","submitted_at":"2025-05-22T17:59:58Z","title":"GoT-R1: Unleashing Reasoning Capability of MLLM for Visual Generation with Reinforcement Learning"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 17 inbound Pith citation observations for arXiv:2505.17022."}