{"as_of":"2026-08-10T04:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:651c58a60be6530db1d0a55b79a39b3bdd68c82ab850877c5f2f8e28ece2b17a","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":9,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":9,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":9,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":9,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:49:03.494449Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T05:16:48.098751Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23905","snapshot_observed_at":"2026-08-07T14:49:03.494449Z","title":"Boosting mllm reasoning with text-debiased hint-grpo.arXiv preprint arXiv:2503.23905, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.17540","last_updated":"2025-05-23T06:44:26Z","snapshot_observed_at":"2026-08-07T20:36:17.159381Z","submitted_at":"2025-05-23T06:44:26Z","title":"RePrompt: Reasoning-Augmented Reprompting for Text-to-Image Generation via Reinforcement Learning","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:49:03.494449Z"},"links":{"cited_paper":"/paper/2503.23905","citing_paper":"/paper/2505.17540"},"observation_digest":"sha256:1224e0fab1461f83674485bc916f52a49fad64ffdefa9fd0c35eefeba384c81f","observation_id":"efb91d72-2bd2-4ef7-9da4-e9e7d1f49cac","resolution":{"observed_at":"2026-08-07T14:49:03.494449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23905","snapshot_observed_at":"2026-08-07T14:19:02.964530Z","title":"Boosting mllm reasoning with text-debiased hint-grpo","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.19406","last_updated":"2025-05-26T01:42:38Z","snapshot_observed_at":"2026-08-07T20:32:06.174757Z","submitted_at":"2025-05-26T01:42:38Z","title":"Unveiling the Compositional Ability Gap in Vision-Language Reasoning Model","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:19:02.964530Z"},"links":{"cited_paper":"/paper/2503.23905","citing_paper":"/paper/2505.19406"},"observation_digest":"sha256:3189070a6f475d09efb1d9b72ba24401d1b6d4333dfa15367db9a0864f911a65","observation_id":"bdc4a137-b272-4730-8576-cbc00ffd0c81","resolution":{"observed_at":"2026-08-07T14:19:02.964530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23905","snapshot_observed_at":"2026-08-04T16:07:30.943890Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.16679","last_updated":"2025-09-20T13:11:28Z","snapshot_observed_at":"2026-08-04T16:07:24.699834Z","submitted_at":"2025-09-20T13:11:28Z","title":"Reinforcement Learning Meets Large Language Models: A Survey of Advancements and Applications Across the LLM Lifecycle","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-04T16:07:30.943890Z"},"links":{"cited_paper":"/paper/2503.23905","citing_paper":"/paper/2509.16679"},"observation_digest":"sha256:609a58d2d4ebd0a4ad4d603d17ed9c73a22c58ef29c0e882d64bd1051fc97668","observation_id":"3966b4c6-aee4-4b0f-a038-e38f848f33ca","resolution":{"observed_at":"2026-08-04T16:07:30.943890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO","version":2},"cited_work":{"arxiv_id":"2503.23905","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.23905","snapshot_observed_at":"2026-07-10T05:16:48.098751Z","title":"Pei Ke, Bosi Wen, Andrew Feng, Xiao Liu, Xuanyu Lei, Jiale Cheng, Shengyuan Wang, Aohan Zeng, Yuxiao Dong, Hongning Wang, and 1 others","venue":"cs.CV","work_id":"df4a012f-d754-4456-9abb-47743d3a28a0","year":2025},"citing_paper":{"arxiv_id":"2601.06794","last_updated":"2026-04-14T15:14:10Z","snapshot_observed_at":"2026-08-02T16:11:51.558737Z","submitted_at":"2026-01-11T07:29:08Z","title":"No More Stale Feedback: Co-Evolving Critics for Open-World Agent Learning","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-16T16:01:48.789986Z"},"links":{"cited_paper":"/paper/2503.23905","citing_paper":"/paper/2601.06794"},"observation_digest":"sha256:45ec8aa38736e761776c92a9967876e40954d19d52be0d8c8881915f447ab424","observation_id":"0df3c921-6629-48d7-8754-f026660e3197","resolution":{"observed_at":"2026-05-16T16:03:04.283411Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.23905","snapshot_observed_at":"2026-08-02T20:14:03.983641Z","title":"Boosting mllm reasoning with text-debiased hint- grpo.arXiv preprint arXiv:2503.23905, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2602.23802","last_updated":"2026-07-08T14:47:50Z","snapshot_observed_at":"2026-08-08T13:47:11.850462Z","submitted_at":"2026-02-27T08:42:52Z","title":"EMO-R3: Reflective Reinforcement Learning for Emotional Reasoning in Multimodal Large Language Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-02T20:14:03.983641Z"},"links":{"cited_paper":"/paper/2503.23905","citing_paper":"/paper/2602.23802"},"observation_digest":"sha256:17ae6c4bff1608e97c3de6415b17487e72996b283e5132c1dd34c58da4f48e0e","observation_id":"88669c8e-ff9e-460f-a9bc-475363cf071b","resolution":{"observed_at":"2026-08-02T20:14:03.983641Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO","version":2},"cited_work":{"arxiv_id":"2503.23905","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.23905","snapshot_observed_at":"2026-07-10T05:16:48.098751Z","title":"Pei Ke, Bosi Wen, Andrew Feng, Xiao Liu, Xuanyu Lei, Jiale Cheng, Shengyuan Wang, Aohan Zeng, Yuxiao Dong, Hongning Wang, and 1 others","venue":"cs.CV","work_id":"df4a012f-d754-4456-9abb-47743d3a28a0","year":2025},"citing_paper":{"arxiv_id":"2605.01338","last_updated":"2026-05-02T09:21:30Z","snapshot_observed_at":"2026-08-02T15:49:26.538948Z","submitted_at":"2026-05-02T09:21:30Z","title":"DiagramNet: An End-to-End Recognition Framework and Dataset for Non-Standard System-Level Diagrams","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-05-09T14:37:35.517734Z"},"links":{"cited_paper":"/paper/2503.23905","citing_paper":"/paper/2605.01338"},"observation_digest":"sha256:1bd81b84c33a2f80ad133dcff2c91d5d80aece0d492e3f0a86aeeaafcf3de30b","observation_id":"290ad136-657d-4a53-8a26-16787c95732e","resolution":{"observed_at":"2026-05-11T16:51:09.196344Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO","version":2},"cited_work":{"arxiv_id":"2503.23905","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.23905","snapshot_observed_at":"2026-07-10T05:16:48.098751Z","title":"Pei Ke, Bosi Wen, Andrew Feng, Xiao Liu, Xuanyu Lei, Jiale Cheng, Shengyuan Wang, Aohan Zeng, Yuxiao Dong, Hongning Wang, and 1 others","venue":"cs.CV","work_id":"df4a012f-d754-4456-9abb-47743d3a28a0","year":2025},"citing_paper":{"arxiv_id":"2605.03485","last_updated":"2026-05-05T08:20:48Z","snapshot_observed_at":"2026-07-06T23:16:25.301792Z","submitted_at":"2026-05-05T08:20:48Z","title":"MHPR: Multidimensional Human Perception and Reasoning Benchmark for Large Vision-Languate Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-08T01:20:54.441367Z"},"links":{"cited_paper":"/paper/2503.23905","citing_paper":"/paper/2605.03485"},"observation_digest":"sha256:e26e82e9628451eb05363e5b709ef89989063fe803e4ac96d79099f8dc7ed81d","observation_id":"4fb533e3-d46d-4869-bc49-8d71a1180f5b","resolution":{"observed_at":"2026-05-12T11:01:30.642654Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO","version":2},"cited_work":{"arxiv_id":"2503.23905","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.23905","snapshot_observed_at":"2026-07-10T05:16:48.098751Z","title":"Pei Ke, Bosi Wen, Andrew Feng, Xiao Liu, Xuanyu Lei, Jiale Cheng, Shengyuan Wang, Aohan Zeng, Yuxiao Dong, Hongning Wang, and 1 others","venue":"cs.CV","work_id":"df4a012f-d754-4456-9abb-47743d3a28a0","year":2025},"citing_paper":{"arxiv_id":"2607.07674","last_updated":"2026-07-08T17:32:58Z","snapshot_observed_at":"2026-07-11T23:20:19.781757Z","submitted_at":"2026-07-08T17:32:58Z","title":"Max Out GRPO Signal: Adaptive Trace Prefix Control for Hard Reasoning Problems","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-09T03:20:40.229376Z"},"links":{"cited_paper":"/paper/2503.23905","citing_paper":"/paper/2607.07674"},"observation_digest":"sha256:e13f131f6964e6a10d39fa39996cbce2f7522d36b620ce4e119d4b4e30a22418","observation_id":"cb77a87f-83cd-4b53-ac29-ce2a0c3b81e7","resolution":{"observed_at":"2026-07-09T03:25:57.810399Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO","version":2},"cited_work":{"arxiv_id":"2503.23905","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.23905","snapshot_observed_at":"2026-07-10T05:16:48.098751Z","title":"Pei Ke, Bosi Wen, Andrew Feng, Xiao Liu, Xuanyu Lei, Jiale Cheng, Shengyuan Wang, Aohan Zeng, Yuxiao Dong, Hongning Wang, and 1 others","venue":"cs.CV","work_id":"df4a012f-d754-4456-9abb-47743d3a28a0","year":2025},"citing_paper":{"arxiv_id":"2607.08572","last_updated":"2026-07-09T15:04:05Z","snapshot_observed_at":"2026-08-02T19:17:35.525533Z","submitted_at":"2026-07-09T15:04:05Z","title":"Switch-Reasoner: Learn When to Think in Multitask Mixtures via Reinforcement Learning","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-10T05:07:40.106099Z"},"links":{"cited_paper":"/paper/2503.23905","citing_paper":"/paper/2607.08572"},"observation_digest":"sha256:e29c1ac77efbaf87f33ee84b2a7ce3ea4efdde934307a503608cafd5e49cdc42","observation_id":"acad75f2-78db-4485-91aa-9a6d2cca548a","resolution":{"observed_at":"2026-07-10T05:16:48.100099Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2503.23905/citation-record","integrity":"/paper/2503.23905/integrity","json":"/paper/2503.23905/citation-record.json","paper":"/paper/2503.23905"},"outbound":[],"paper":{"arxiv_id":"2503.23905","last_updated":"2025-06-27T14:37:02Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T16:25:36.572641Z","submitted_at":"2025-03-31T09:54:55Z","title":"Boosting MLLM Reasoning with Text-Debiased Hint-GRPO"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 9 inbound Pith citation observations for arXiv:2503.23905."}