{"as_of":"2026-08-08T11:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f4ba94e4f202e94661859a71d6b7fedae4b122fbb40884b594e36e02d31d0817","coverage":[{"denominator":32,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":32,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:27:46.110145Z","state":"measured"},{"denominator":32,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":32,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.18048/citation-record","integrity":"/paper/2506.18048/integrity","json":"/paper/2506.18048/citation-record.json","paper":"/paper/2506.18048"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-06T23:27:45.974336Z","title":"Qwen2.5-vl technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.974336Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:a50eab65fc65d518417697e47ee63e57687d18d83298cdfee0f348b9157869ef","observation_id":"888e2e60-e219-475c-aaa1-b528e274bd99","resolution":{"observed_at":"2026-08-06T23:27:45.974336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.12191","last_updated":"2024-10-03T15:54:49Z","snapshot_observed_at":"2026-08-06T05:35:29.109022Z","submitted_at":"2024-09-18T17:59:32Z","title":"Qwen2-VL: Enhancing Vision-Language Model's Perception of the World at Any Resolution","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.12191","snapshot_observed_at":"2026-08-06T23:27:45.979535Z","title":"Qwen2-vl: Enhancing vision-language model’s perception of the world at any resolution,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.979535Z"},"links":{"cited_paper":"/paper/2409.12191","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:9d0faf8dd0689721c8718d2f7c42954eab947c24cd4ab762d5d4ad02a76eb5c5","observation_id":"a1cba944-ef9a-4c3a-a1c9-8028410c4f07","resolution":{"observed_at":"2026-08-06T23:27:45.979535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.12966","last_updated":"2023-10-13T02:41:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-24T17:59:17Z","title":"Qwen-VL: A Versatile Vision-Language Model for Understanding, Localization, Text Reading, and Beyond","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.12966","snapshot_observed_at":"2026-08-06T23:27:45.983521Z","title":"Qwen-vl: A versatile vision-language model for understanding, localization, text reading, and beyond,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.983521Z"},"links":{"cited_paper":"/paper/2308.12966","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:72b360d21dba9c92c14ac0edd4bc520ca1fefddc3269844f304098c526b6c116","observation_id":"f2dd7f1e-2c03-4ef2-a355-09707d2a1102","resolution":{"observed_at":"2026-08-06T23:27:45.983521Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-06T23:27:45.989262Z","title":"Internvl3: Exploring advanced training and test-time recipes for open-source multimodal models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.989262Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:bc055fdaf00166c62432b23d3ab9e47919fcde7680e8e9c28231efc756db664f","observation_id":"cba8af1b-81fd-4ced-9f49-ae5ffed51561","resolution":{"observed_at":"2026-08-06T23:27:45.989262Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.467214Z","title":"Mini-internvl: a flexible-transfer pocket multi-modal model with 5% parameters and 90% performance,","venue":null,"work_id":"d755db99-c557-4fb7-b040-91d292bb75ab","year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.994230Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:ab4c09bf8a58375ff788c2bb2cc4f747794ff9947db5aaa6ecbe92f27b9b76ce","observation_id":"90a389ff-562d-4d1b-91ea-8c4c79769133","resolution":{"observed_at":"2026-08-06T23:27:46.470968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:45.999090Z","title":"Internvl: Scaling up vision foundation models and aligning for generic visual-linguistic tasks,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:45.999090Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:6360add30616adbe436d91e4440d2a157ca4108cdf59445de3c6f88674111b44","observation_id":"6d3a24bb-b916-4c08-ab3f-7e6750106c24","resolution":{"observed_at":"2026-08-06T23:27:45.999090Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.19437","last_updated":"2025-02-18T17:26:38Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-27T04:03:16Z","title":"DeepSeek-V3 Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.19437","snapshot_observed_at":"2026-08-06T23:27:46.003577Z","title":"Deepseek-v3 technical report,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.003577Z"},"links":{"cited_paper":"/paper/2412.19437","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:a93194872f94c1507a135896dfa2f07fb38cc97b9efc8832bd9861e7ca5395bb","observation_id":"50e3175e-3585-44a1-98de-9522d7dd512d","resolution":{"observed_at":"2026-08-06T23:27:46.003577Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T23:27:46.007744Z","title":"Deepseek-r1: Incentivizing reasoning capability in llms via reinforcement learning,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.007744Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:389fbf6ea499dc7c9076186265e2206ddcdc213d772a643a4019ade1ff2f538c","observation_id":"e0358bca-d770-4939-a258-2b3bc14b349a","resolution":{"observed_at":"2026-08-06T23:27:46.007744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10302","last_updated":"2024-12-13T17:37:48Z","snapshot_observed_at":"2026-08-07T03:01:29.031129Z","submitted_at":"2024-12-13T17:37:48Z","title":"DeepSeek-VL2: Mixture-of-Experts Vision-Language Models for Advanced Multimodal Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.10302","snapshot_observed_at":"2026-08-06T23:27:46.011940Z","title":"Deepseek-vl2: Mixture-of-experts vision-language models for advanced multimodal understanding,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.011940Z"},"links":{"cited_paper":"/paper/2412.10302","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:9c73b4c1572a75ac8c9483992d554eb995799c2e8d6dcc169328c2996ab26555","observation_id":"42dd53b1-eaeb-4e1d-b910-9944b3080290","resolution":{"observed_at":"2026-08-06T23:27:46.011940Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.449566Z","title":"Deepseek-vl: Towards real-world vision-language understanding,","venue":null,"work_id":"14ab36fe-5e91-4b22-a21e-1224b9bd092a","year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.016387Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:ce228d131a486bec03dc860e2b9ddfa2816d6a6956bd5db0f3405467672c0f70","observation_id":"d0fb5213-c107-4e06-92fa-b3a58308bd0f","resolution":{"observed_at":"2026-08-06T23:27:46.453110Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.438818Z","title":"Fastvlm: Efficient vision encoding for vision language models,","venue":null,"work_id":"18be5af0-a0d7-455d-b1c2-ef92cb3dea17","year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.019994Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:f762af415ec36dafec2d3ec687474a973c6ba0fa2ced7c57f4f027b49d46fbae","observation_id":"5f0c31ce-2ba5-405e-8461-e7f9f6165736","resolution":{"observed_at":"2026-08-06T23:27:46.442658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.427754Z","title":"Emoset: A large-scale visual emotion dataset with rich attributes,","venue":null,"work_id":"768c247f-b54f-4245-b051-b061d929f114","year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.023951Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:e4a2330f628c26be905f8a8a825c667986cbe877684d66b14b73c4637515d375","observation_id":"ed8b03db-ccc0-4a2b-9581-1552711e4495","resolution":{"observed_at":"2026-08-06T23:27:46.431841Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.027925Z","title":"How far are we to gpt-4v? closing the gap to commercial multimodal models with open-source suites,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.027925Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:087e4ade92e9c3fcd0c3f6a1668c588369db7638d24ad5ed9a754bb3f7304d79","observation_id":"ce9df91b-8665-4023-9d7b-f4c7c11313ee","resolution":{"observed_at":"2026-08-06T23:27:46.027925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-06T23:27:46.031851Z","title":"Deepseekmath: Pushing the limits of mathematical reasoning in open language models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.031851Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:2d1e9c4c7fd2f9a69ab431d63d9133ae65463f0604f5943c71a3546c54909132","observation_id":"206915a0-b4c3-415f-a14c-faa7b1913a53","resolution":{"observed_at":"2026-08-06T23:27:46.031851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.14476","last_updated":"2025-05-20T01:37:34Z","snapshot_observed_at":"2026-08-02T01:40:54.187278Z","submitted_at":"2025-03-18T17:49:06Z","title":"DAPO: An Open-Source LLM Reinforcement Learning System at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.14476","snapshot_observed_at":"2026-08-06T23:27:46.035574Z","title":"Dapo: An open-source llm reinforcement learning system at scale,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.035574Z"},"links":{"cited_paper":"/paper/2503.14476","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:88febcee45db92e9bcd9f966eaefb0b141018caf07d1cad005b070a82e9dd76d","observation_id":"5ed44390-3232-42df-8999-d4f09e64286c","resolution":{"observed_at":"2026-08-06T23:27:46.035574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.16886","last_updated":"2023-12-30T04:59:21Z","snapshot_observed_at":"2026-07-29T22:12:01.108911Z","submitted_at":"2023-12-28T08:21:24Z","title":"MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.16886","snapshot_observed_at":"2026-08-06T23:27:46.040045Z","title":"Mobilevlm: A fast, reproducible and strong vision language assistant for mobile devices,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.040045Z"},"links":{"cited_paper":"/paper/2312.16886","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:6ac5a9478ec2312b68ef9f8ae44209d36bbb78a7258984102ec2bdd14078fa62","observation_id":"e1df0161-d7f3-42f0-8aef-8431d30554c3","resolution":{"observed_at":"2026-08-06T23:27:46.040045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.10442","last_updated":"2025-04-07T09:09:39Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-11-15T18:59:27Z","title":"Enhancing the Reasoning Ability of Multimodal Large Language Models via Mixed Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.10442","snapshot_observed_at":"2026-08-06T23:27:46.044306Z","title":"Enhancing the reasoning ability of multimodal large language models via mixed preference optimization,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.044306Z"},"links":{"cited_paper":"/paper/2411.10442","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:7f38b090251c2a085fe94355e75ba0499f5d3c32d13bf10069a614674e79948b","observation_id":"89775a5f-8141-4c5f-9d31-b8158f2da8b5","resolution":{"observed_at":"2026-08-06T23:27:46.044306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09498","last_updated":"2025-05-14T15:45:17Z","snapshot_observed_at":"2026-08-07T15:45:23.297247Z","submitted_at":"2025-05-14T15:45:17Z","title":"Flash-VL 2B: Optimizing Vision-Language Model Performance for Ultra-Low Latency and High Throughput","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09498","snapshot_observed_at":"2026-08-06T23:27:46.048132Z","title":"Flash-vl 2b: Optimizing vision-language model perfor- mance for ultra-low latency and high throughput,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.048132Z"},"links":{"cited_paper":"/paper/2505.09498","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:4a45ae78cee54815ab46df683631fc6cb18803a80eec40835f5999e9d0b58abb","observation_id":"c8760376-d25b-4280-92e6-05e754f0d73a","resolution":{"observed_at":"2026-08-06T23:27:46.048132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.410609Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":"9ab0f050-50ed-4044-aa44-87a4afd52836","year":null},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.055921Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:150a0f6d076d4c8cc7c6cbe0222068bd07a4889107853c3e0f679ceccf42640a","observation_id":"c480aeb5-07ba-42a7-8fbf-2accc3867fe6","resolution":{"observed_at":"2026-08-06T23:27:46.414377Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.397793Z","title":"Bluelm: An open multilingual 7b language model,","venue":null,"work_id":"f363c142-2cd2-4fbf-bdbf-be0373f87d3d","year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.065185Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:9ba721232c3d747711f2f081568c1ff64dbe8e001f4aaa57859a972fbc4a9631","observation_id":"d207f646-328b-46ae-86d1-f2c88e1be30d","resolution":{"observed_at":"2026-08-06T23:27:46.401648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-06T23:27:46.069055Z","title":"Qwen3 technical report,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.069055Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:bd629347a041629a8acdcb088608e66d559bdbcd08caf2e23996a1dce9aaa39a","observation_id":"ceb4a625-f154-4dfd-a0d3-1f6ddc62b22b","resolution":{"observed_at":"2026-08-06T23:27:46.069055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-06T23:27:46.073417Z","title":"Expanding performance boundaries of open-source multimodal models with model, data, and test-time scaling,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.073417Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:0f6f7a12cb9f09ece62c6e37a81bb62a9685b02f86e04563acab1f13743ab672","observation_id":"de30002b-577a-4f35-9999-6e7832abf485","resolution":{"observed_at":"2026-08-06T23:27:46.073417Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.386300Z","title":"Visual cot: Advancing multi-modal language models with a comprehensive dataset and benchmark for chain-of-thought reasoning,","venue":null,"work_id":"aa5acb94-9899-4ffc-b926-a1978a065cc0","year":2024},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.077559Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:0333c0ebaa7ec68944f5c545297b5e243fd9b48af6ececd3b747ba66633870df","observation_id":"3b9f84a9-5d91-40d6-9fce-e92fbd59d6e5","resolution":{"observed_at":"2026-08-06T23:27:46.390168Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.375358Z","title":"Cot-vla: Visual chain-of- thought reasoning for vision-language-action models,","venue":null,"work_id":"f2e4de5f-7210-477c-9a9a-b73fc0b2984d","year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.082144Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:788b0dbd437a339daff117d5dbbf86de110f73c01d3417d05854344fe80235c9","observation_id":"9bcb828f-6da3-46a2-ba53-51a42189d87b","resolution":{"observed_at":"2026-08-06T23:27:46.379161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-06T23:27:46.086111Z","title":"Proximal policy optimization algorithms,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.086111Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:02afa03a5b7d81603f3649ad5600251782299f395c15fa33f660ff3742222894","observation_id":"ee782dab-a378-4cef-afb2-e68922e5d2a0","resolution":{"observed_at":"2026-08-06T23:27:46.086111Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.364689Z","title":"Direct preference optimization: Your language model is secretly a reward model,","venue":null,"work_id":"c53bf386-35b8-4b29-b1a3-c21a1f2b11a4","year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.090218Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:0ddb4482721cc5f0d0bcd5f36e762850f9eca513e778bf5aa9e2f996f8060b3c","observation_id":"d977a308-3fa7-47c9-a607-864a0119acc8","resolution":{"observed_at":"2026-08-06T23:27:46.368226Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.03095","last_updated":"2025-02-05T11:41:43Z","snapshot_observed_at":"2026-08-03T23:39:49.515711Z","submitted_at":"2025-02-05T11:41:43Z","title":"Reveal the Mystery of DPO: The Connection between DPO and RL Algorithms","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.03095","snapshot_observed_at":"2026-08-06T23:27:46.094169Z","title":"Reveal the mystery of dpo: The connection between dpo and rl algorithms,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.094169Z"},"links":{"cited_paper":"/paper/2502.03095","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:e518b727f169bef33cb3e83576bf7291d36738ea2595c79dc475dfb17a626fc8","observation_id":"d4c51025-8c1d-4790-a00e-684a8a9963f4","resolution":{"observed_at":"2026-08-06T23:27:46.094169Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20783","last_updated":"2025-10-06T09:30:03Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T17:59:14Z","title":"Understanding R1-Zero-Like Training: A Critical Perspective","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20783","snapshot_observed_at":"2026-08-06T23:27:46.098401Z","title":"Understanding r1-zero-like training: A critical perspective,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.098401Z"},"links":{"cited_paper":"/paper/2503.20783","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:da4ce166436d8ab3cd07e685cbf6e97fec52550cad59e72c72a9593cd8e683e8","observation_id":"c14be14c-f2bb-49ec-8019-2b136d1f5c00","resolution":{"observed_at":"2026-08-06T23:27:46.098401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.05348","last_updated":"2024-08-28T14:26:07Z","snapshot_observed_at":"2026-07-06T16:45:11.604296Z","submitted_at":"2023-11-09T13:18:27Z","title":"u-LLaVA: Unifying Multi-Modal Tasks via Large Language Model","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.05348","snapshot_observed_at":"2026-08-06T23:27:46.102560Z","title":"u-llava: Unifying multi-modal tasks via large language model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.102560Z"},"links":{"cited_paper":"/paper/2311.05348","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:3c0e1139a17dcaaf5f845a7893bdc644c76263d9ac83cc71ea020d4a68fdb568","observation_id":"3e0302b2-4c90-4d32-b153-02826c9f8c20","resolution":{"observed_at":"2026-08-06T23:27:46.102560Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.352231Z","title":"Reproducibility companion paper: u-llava: Unifying multi-modal tasks via large language model,","venue":null,"work_id":"f33841f3-9cc7-46e6-88a8-08a8f8754712","year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.106556Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:593b62d45746191fe43ec460f14f133f6e9ffc57448944677136a78d1ed8d88b","observation_id":"6fe2d866-1107-4922-acda-7c305a133f15","resolution":{"observed_at":"2026-08-06T23:27:46.357321Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T23:27:46.337640Z","title":"Overcoming heterogeneous data in federated medical vision-language pre-training: A triple-embedding model selector approach,","venue":null,"work_id":"bc1c000f-2cdb-48a1-8757-0be5543bae41","year":2025},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.110145Z"},"links":{"citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:c29999e6b2dad9234f2c34413e14824e865a360bbc10766a3a3350a76b37fd53","observation_id":"83592d12-7e03-4866-aeeb-60cdca07b7c4","resolution":{"observed_at":"2026-08-06T23:27:46.344292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18290","last_updated":"2024-07-29T22:26:36Z","snapshot_observed_at":"2026-08-01T16:34:38.795326Z","submitted_at":"2023-05-29T17:57:46Z","title":"Direct Preference Optimization: Your Language Model is Secretly a Reward Model","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18290","snapshot_observed_at":"2026-08-06T23:27:46.060328Z","title":"Available: https://arxiv.org/abs/2305.18290","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs","version":2},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T23:27:46.060328Z"},"links":{"cited_paper":"/paper/2305.18290","citing_paper":"/paper/2506.18048"},"observation_digest":"sha256:cc5a189a5a2d2c4360a8f45a01b3806ced5e29b53890fcfc6f8ce1d2d08a181a","observation_id":"cdb15741-233e-411b-970c-9479855144e2","resolution":{"observed_at":"2026-08-06T23:27:46.060328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2506.18048","last_updated":"2025-08-11T14:18:57Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T22:53:48.054431Z","submitted_at":"2025-06-22T14:32:15Z","title":"CLGRPO: Reasoning Ability Enhancement for Small VLMs"},"reference_resolution":{"displayed":32,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":32},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 32 of 32 outbound references and 0 inbound Pith citation observations for arXiv:2506.18048."}