{"as_of":"2026-08-14T23:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:4c50cdd0322bd73132e7e708051b812b2efebb9cd947b78a71214b71a92c2124","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T10:32:39.790036Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.09871/citation-record","integrity":"/paper/2606.09871/integrity","json":"/paper/2606.09871/citation-record.json","paper":"/paper/2606.09871"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-11T14:42:37.584016Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:bb06c97ef38b9870b3268499f7d9a245ba9cad77eb56701001830219024a8fc4","observation_id":"2f6f8420-c1b8-4f85-a7e9-5f457d104e0b","resolution":{"observed_at":"2026-07-02T02:56:28.798021Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"METEOR: An automatic metric for MT evaluation with improved correlation with human judgments","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:b7de9da00f25141cb368fd0502ad6f9ba7c3df5956cc87015de1748113ecba74","observation_id":"64092096-0849-4d05-94d5-52bdee043be7","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"SciBERT: A pretrained language model for scientific text","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:e330ca1ff639917af289f2b64743af90b824172dcfe95e3a8ba4ac51e5c197e7","observation_id":"c191b8d7-0163-49e2-b822-820f041e25d3","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"R1-v: Reinforcing super generalization ability in vision-language models with less than $3.https://github.com/Deep-Agent/R1-V, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:91fea68379bb55c6eae251f3dbce15d364e0577e618e21d8f73fc6798452bfb4","observation_id":"40c08b2d-178d-45e6-a8aa-ad59b71d752d","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01551","last_updated":"2025-07-03T10:33:08Z","snapshot_observed_at":"2026-08-07T16:44:48.826198Z","submitted_at":"2025-07-02T10:05:14Z","title":"Self-Guided Process Reward Optimization with Redefined Step-wise Advantage for Process Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2507.01551","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.01551","snapshot_observed_at":"2026-07-27T01:21:11.025340Z","title":"Self-guided process reward optimization with redefined step-wise advantage for process reinforcement learning","venue":null,"work_id":"46aebc80-edc3-4ba9-b02c-885044c3afd5","year":2025},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/2507.01551","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:d4d739f9155d127e769df8e7e1d01b4ccf79c02263ceed6ea591fb93344ff434","observation_id":"ce423fa1-35ef-4723-92ce-bcba801cbb08","resolution":{"observed_at":"2026-07-27T01:21:11.025340Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Group-in-group policy optimization for LLM agent training.Advances in Neural Information Processing Systems, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:a2ee3b28534216f253f69cb4cc26baa0411f450daaf5b6bd9d1ba67a847ad08c","observation_id":"98bce25d-fee3-4eda-90f6-ecbe8035b3f4","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.07320","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T02:56:28.792528Z","title":"Segmental advantage estimation: Enhancing ppo for long-context llm training","venue":null,"work_id":"3d35e4e7-ce88-4629-85d5-b1c494bd0df2","year":2026},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:2c13d0b94d8e4a1178959bd3005c459526024629cddd454adb41c3fd5749292e","observation_id":"424cdf34-d1c4-4ff5-9f94-17f9d5cabc21","resolution":{"observed_at":"2026-07-02T02:56:28.794467Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-08-13T15:58:13.809876Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":"2501.12948","doi":"10.1016/j.artmed.2024.103001","metadata_source":"pith","pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","venue":"cs.CL","work_id":"e6b75ad5-2877-4168-97c8-710407094d20","year":2025},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:892cf3ac40a0ef2e9e1e35f1506ea582e2dd50fbd73fad5c5be3381d83254ebd","observation_id":"50c012bb-1347-45b0-b2ed-d5ea318cb45f","resolution":{"observed_at":"2026-07-02T02:56:28.826738Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Segment policy optimization: Effective segment- level credit assignment in RL for large language models.Advances in Neural Information Processing Systems, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:c129dd45b287e16508952687a449a321e4eec63d94ee6c5150e91b72ced45c33","observation_id":"44154644-ebe2-41c1-8ac2-6c750a04e900","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"mTORC2 signalling regulates M2 macrophage differentiation in response to helminth infection and adaptive thermogenesis.Nature communications, 8(1):14208, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:c83e5b241035507cd1cdc457f346ffaf2617038f93c39ba5982d44a1e5780e56","observation_id":"5b40e274-386d-4e79-96c9-3b65441facd5","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"SciCap: Generating captions for scientific figures","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:d3aa6fbc0c5258fd16caa349f5ffe54650b55e5f108f08766c67d07b9dcf8bf5","observation_id":"1febbb65-4ea4-4570-adc0-03fe00401683","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":"2503.06749","doi":"10.48550/arxiv.2503.06749","metadata_source":"pith","pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","venue":"cs.CV","work_id":"38998646-34ee-4605-b661-ab356f16d6e5","year":2025},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:ffa2ea1ebee991d662c43c1bed3cbc0842a61aec65af6ac835db4a2d39d60b0f","observation_id":"272a04cd-f221-4461-acf3-76e5c0292e71","resolution":{"observed_at":"2026-07-02T02:56:28.814795Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:3d75f3cec79de5205719373aedd9f1d03a7114fea92457dd5a87885525417bf7","observation_id":"9523071e-95d9-4c3e-bf8f-2a202d8c51c4","resolution":{"observed_at":"2026-07-02T02:56:28.809123Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Mimic-cxr, a de-identified publicly available database of chest radiographs with free-text reports.Scientific data, 6(1):317, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:ee1032201b5e3a21e62de38bd254232d5aa74ebe920de9dbb5669f244ed62cfe","observation_id":"cd5c1bdd-c898-43dd-9639-55b508bea31f","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Vrsbench: A versatile vision-language benchmark dataset for remote sensing image understanding.Advances in Neural Information Processing Systems, 37:3229– 3242, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:f79527d7cadaa64ba3eb6bd386906e5f4918983d3ac6c97384b22586eb2cdf71","observation_id":"fd83b978-2273-4778-8f51-6cad4c030acb","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Hybrid retrieval-generation reinforced agent for medical image report generation.Advances in neural information processing systems, 31, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:bc639beab8e69516deed5edaf8e63ace1525b22c87b0c01d5f2ea744eebea9d2","observation_id":"1ea6e62e-83bb-4ad5-a82f-79c5854e6327","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04903","last_updated":"2025-02-20T05:57:34Z","snapshot_observed_at":"2026-08-13T18:20:37.926570Z","submitted_at":"2024-07-06T00:40:53Z","title":"MMSci: A Dataset for Graduate-Level Multi-Discipline Multimodal Scientific Understanding","version":3},"cited_work":{"arxiv_id":"2407.04903","doi":"10.48550/arxiv.2407.04903","metadata_source":"pith","pith_arxiv_id":"2407.04903","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wilson, Woosang Lim, and William Yang Wang","venue":"cs.CL","work_id":"c3fad474-8ba8-487e-8bbb-d493d804b738","year":2024},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/2407.04903","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:2bd5ebcc7088c215b544e7a3572e3e86057e67b30a2dbb5983a46306e3000ec2","observation_id":"f580ae4d-a537-42ed-94cb-ee6e016c79c2","resolution":{"observed_at":"2026-07-02T02:56:28.805174Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Photolatently modulable hydrogels using unilamellar titania nanosheets as photocatalytic crosslinkers.Nature Communications, 4 (1):2029, 2013","venue":null,"work_id":null,"year":2029},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:4920f5f273d36725452fc58de6e43411569af9fc9357820e41253c12fa720a61","observation_id":"66070811-0be9-40a5-9c68-3fb2ad5f9af5","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Improved image captioning via policy gradient optimization of spider","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:7dc86c2e08c5bc5f2bcf19de9e03e33112b26c5b5cc541404a49cca5a39a7363","observation_id":"8e9a8d43-ddfa-49f3-9cce-be5421a2b16a","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-08-13T12:34:54.476684Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":"2503.20783","doi":"10.48550/arxiv.2503.20783","metadata_source":"pith","pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","venue":"cs.LG","work_id":"ec354f3b-9484-4a0c-94c8-92d4d0260835","year":2025},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:fc4d3e306866815fc225a5c796c161092d020f1e160a3a5716c3e65e3ae14a8e","observation_id":"15a827ee-9d62-4169-8db1-25b795a265d6","resolution":{"observed_at":"2026-07-02T02:56:28.823260Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-05-24T09:23:05.84445+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-24T09:23:05.84445+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:04e5c2515aeca146a4a60baa670adb7c31441b44f48f88fd9adc46ac1b9fdb05","observation_id":"13b1bb5b-58d1-472f-be2f-03b125245104","resolution":{"observed_at":"2026-07-02T02:56:28.818694Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"DOCCI: Descriptions of Connected and Contrasting Images","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:a045c4b20d7e39b634bad752599b7cbfeff542c84d172eef5817e80feaf5d7b5","observation_id":"20eb58a8-e4a8-483a-b1bf-098f5844d14d","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Bleu: a method for automatic evaluation of machine translation","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:ab20f9d1afa6b4a0d4e9f0a8a89f181a95b28776b2ca79a1ee2f6142b9a3ce01","observation_id":"2bd9c1b6-a60c-425a-8964-2de01429f16b","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.10231","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T02:56:28.817884Z","title":"Blockwise advantage estimation for multi-objective rl with verifiable rewards.arXiv preprint arXiv:2602.10231, 2026","venue":null,"work_id":"782f658b-bac3-478f-9855-a6232bdb8deb","year":2026},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:6e5f8d1a92a9325cc2d41280aaf9c826d5cd7a68c110fa21613dea7ddde4722a","observation_id":"2b5ad5c6-cdca-41db-931f-a65896672aa3","resolution":{"observed_at":"2026-07-02T02:56:28.820028Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07536","last_updated":"2025-03-11T03:32:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-10T17:04:14Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","version":2},"cited_work":{"arxiv_id":"2503.07536","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.07536","snapshot_observed_at":"2026-07-04T10:39:45.355868Z","title":"LMM-R1: Empowering 3B LMMs with Strong Reasoning Abilities Through Two-Stage Rule-Based RL","venue":"cs.CL","work_id":"30c18d3e-432d-404b-9572-1c7375bee8ed","year":2025},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/2503.07536","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:4dccc92c5e1d2de268758ce8bbc38237aae0b865b43a587b25832ab87c7b4416","observation_id":"8368d3aa-781d-4dc5-a227-81fdbe174a8d","resolution":{"observed_at":"2026-07-02T02:56:28.830302Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Self-critical sequence training for image captioning","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:f40930ccea6aad8a5d7749765a9c315a49dec5469edb7159a72c09dd4ed57cb8","observation_id":"8e742842-48a1-49d1-8d78-c5f46e5dbeb4","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:dfd67a8b05c759897053ecbbb06dc16f3c4bf5b6d3cefd3a8230401c6c058b34","observation_id":"7be6383e-d37f-49bc-b4d2-3a8123baa1f4","resolution":{"observed_at":"2026-07-02T02:56:28.812511Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:8d65e44817a9c0ff816ca743729d130b143f6523fd1482c4c7ebc91d34c15e21","observation_id":"ddee583b-3a7e-42c6-ae23-46d22750a1ed","resolution":{"observed_at":"2026-07-02T02:56:28.833633Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"A picture is worth more than 77 text tokens: Evaluating clip-style models on dense captions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:5c5e6cbf4ed89eba3ddfdc3688c344460ecde5a18f145cc954ae55c08f0c1f66","observation_id":"b28a1d9e-d121-4590-ad96-fd3e4694fdd5","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Cider: Consensus-based image description evaluation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:15eba71e7949f6dcf06f7d0cd167818d93715e704812769fd3b358d2cb649797","observation_id":"93f6d554-9ef5-4931-9acf-18069346d222","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12122","last_updated":"2024-09-18T16:45:37Z","snapshot_observed_at":"2026-08-14T16:00:41.902820Z","submitted_at":"2024-09-18T16:45:37Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","version":1},"cited_work":{"arxiv_id":"2409.12122","doi":"10.18653/v1/2025.emnlp-main.712","metadata_source":"pith","pith_arxiv_id":"2409.12122","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen2.5-Math Technical Report: Toward Mathematical Expert Model via Self-Improvement","venue":"cs.CL","work_id":"a097c5d4-6d32-46ee-9826-57d532bbfc9c","year":2024},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/2409.12122","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:30a8a5a13dc84a24497d4e99ed58911f6b20ae75ec40af2bc41e2f870271e89e","observation_id":"766777f8-a70b-4d70-93eb-5990e0475588","resolution":{"observed_at":"2026-07-02T02:56:28.787289Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Bartscore: Evaluating generated text as text generation","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:38cf0b26540ad5784d1f8e5c7ec6824621d9487d82979a17859e9150a3b3ba67","observation_id":"189c3fc9-a4ca-46df-83fe-5a5b5eeb7fed","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1904.09675","last_updated":"2020-02-24T18:59:28Z","snapshot_observed_at":"2026-07-29T15:42:51.774083Z","submitted_at":"2019-04-21T23:08:53Z","title":"BERTScore: Evaluating Text Generation with BERT","version":3},"cited_work":{"arxiv_id":"1904.09675","doi":"10.48550/arxiv.1904.09675","metadata_source":"pith","pith_arxiv_id":"1904.09675","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"BERTScore: Evaluating Text Generation with BERT","venue":"cs.CL","work_id":"9eaaaac1-0a96-4f5f-9b13-30c46e9e1346","year":2019},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"cited_paper":"/paper/1904.09675","citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:2f0181b9e6fbffd59740e68634a9017a1ec90c8ba61840da71645837b976b0b9","observation_id":"323d30ed-ae4d-4ad1-9fb4-f38185be8dc7","resolution":{"observed_at":"2026-07-02T02:56:28.837017Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-04T01:08:14.227491+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-04T01:08:14.227491+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"Describe each panel","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:aba1a8b673eee5d41c3e9fab63306e17b2fd06ff3b15b763f9ae81650562db3a","observation_id":"6468ba4c-c22d-4b2a-bfc4-badc8c8345ff","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:2ab6b4e44c89035156229181e9b0c8d3e3564d1b99395c8a3d6c1cd0bbfa7bb2","observation_id":"ae8bed49-fc06-4c55-8f65-5d1cbb944ef3","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:a7951b6e71a05980f24325aa2ae54ca6483bc3de86ba41df64f105c94147f259","observation_id":"e2951d76-3560-4755-81b3-f6e7f7b98549","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":"accuracy","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:53f9fff85e49986a26a302eaeac47bfb5aba73e5a4168716af784134d14d4090","observation_id":"de6d46b9-a1eb-4099-9062-f485529295eb","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:7dd3c9d6fe51a59362185c7175d04beefad9bae2463838f7007b5d832c4bc1cc","observation_id":"73a0a4cf-11e3-4da0-a4e1-81927d81cd7f","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T10:32:39.790036Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:4a88742fc3a1baf9099537ae00fa655810913500cdcaf14f19222106638de615","observation_id":"4b51d290-b54f-49cc-b7bc-312888dfdd77","resolution":{"observed_at":"2026-06-28T10:32:39.790036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1850.40410","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T02:56:28.795809Z","title":"A\", \"B\",","venue":null,"work_id":"eaa75448-ac04-4c63-8c1a-c32249253f1f","year":null},"citing_paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T10:32:39.790036Z"},"links":{"citing_paper":"/paper/2606.09871"},"observation_digest":"sha256:4ff68b354fa7f97d2ce06bf8f2d14568e848358e7aa344ece376435f2f181a66","observation_id":"a76fb032-bd2e-4fde-8b05-045bd73ca8ec","resolution":{"observed_at":"2026-07-02T02:56:28.797729Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-14T06:32:32.682623+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.09871","last_updated":"2026-06-02T07:50:50Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-12T15:09:36.727038Z","submitted_at":"2026-06-02T07:50:50Z","title":"SD-GRPO: Verifiable Segment Decomposition for Long-Form Vision-Language Generation"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":23,"verified_exact":15,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2606.09871."}