{"as_of":"2026-08-20T01:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:cce6c1c3979dfa4f74beea17455520e84a6d4f5f3cb47a8a191ce755109d8fd8","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-05T04:29:52.480873Z","state":"measured"},{"denominator":52,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":52,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T00:28:16.418799Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-02T11:56:55.441145Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"cited_work":{"arxiv_id":"2604.20328","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.20328","snapshot_observed_at":"2026-07-02T11:56:55.441145Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","venue":"cs.CV","work_id":"7054cfe7-a92c-4c48-88ae-cb42b4c6031b","year":2026},"citing_paper":{"arxiv_id":"2606.05769","last_updated":"2026-06-04T06:53:19Z","snapshot_observed_at":"2026-08-13T09:56:57.676160Z","submitted_at":"2026-06-04T06:53:19Z","title":"Imagine Before You Predict: Interleaved Latent Visual Reasoning for Video Event Prediction","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-06-28T02:46:50.373450Z"},"links":{"cited_paper":"/paper/2604.20328","citing_paper":"/paper/2606.05769"},"observation_digest":"sha256:4d15290eaa17b03e08c471060433b7748023d933e73ab9591f4edac185c0048f","observation_id":"2132d760-2a50-48f8-b4cd-8d72519d1bc3","resolution":{"observed_at":"2026-07-02T11:56:55.442936Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20328","snapshot_observed_at":"2026-07-31T16:13:17.560110Z","title":"arXiv preprint arXiv:2604.20328 , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28154","last_updated":"2026-07-30T12:57:45Z","snapshot_observed_at":"2026-08-14T07:25:54.528363Z","submitted_at":"2026-07-30T12:57:45Z","title":"OPLD: On-Policy Latent Distillation for Multimodal Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-07-31T16:13:17.560110Z"},"links":{"cited_paper":"/paper/2604.20328","citing_paper":"/paper/2607.28154"},"observation_digest":"sha256:5843e1f645c402d8157f7fc7f947fd6fbc1daf52264a95793a8e20d2d281f2ee","observation_id":"8713d1dc-cb60-4e01-b1e3-bb1cd2f1d69f","resolution":{"observed_at":"2026-07-31T16:13:17.560110Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.20328","snapshot_observed_at":"2026-08-05T00:28:16.418799Z","title":"Cheng,T.;Chen,S.-Z.;Zhang,H.;Qin,Y.;Luo,J.;andWei, Z","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.00743","last_updated":"2026-08-01T16:27:45Z","snapshot_observed_at":"2026-08-18T23:30:27.954757Z","submitted_at":"2026-08-01T16:27:45Z","title":"LUT: Latent Utility Training for Visual Reasoning","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T00:28:16.418799Z"},"links":{"cited_paper":"/paper/2604.20328","citing_paper":"/paper/2608.00743"},"observation_digest":"sha256:187de328c82137b1af6429eb8f9df01bbba4eb0d0d847d4df9f87fbebdd46be9","observation_id":"389d8bdc-1ddf-4c21-8c6a-cb377fd0e543","resolution":{"observed_at":"2026-08-05T00:28:16.418799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2604.20328/citation-record","integrity":"/paper/2604.20328/integrity","json":"/paper/2604.20328/citation-record.json","paper":"/paper/2604.20328"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-08-17T13:26:10.378579Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:5cb5fa50c7e7035e8e838abac111818cfb240a3f0ead30977399cf2e3f6790c5","observation_id":"b9c62fb1-730c-4905-838d-82b21fd37c49","resolution":{"observed_at":"2026-07-05T04:30:40.727597Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.788672Z","title":"Cheng et al","venue":null,"work_id":"d8ea85db-9f85-415c-b4c1-a7a4fd4fdd38","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:4916b597e1f3923a65f3cf365ac684d44897fcbb35fcccf4d33f022fb9418eca","observation_id":"72aee3d9-e54d-4cd1-8ed2-2c47aa212ee3","resolution":{"observed_at":"2026-07-05T04:30:40.789886Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.794350Z","title":"In: Forty-second International Conference on Machine Learning (2025)","venue":null,"work_id":"cad0947b-de44-4114-bb35-629561cc90cb","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:f66d05eedd3db94ff22a764c217a37eac7fcee7fcc8b4ea83254114fdc24d642","observation_id":"712a85a6-1c21-4282-8f3b-8cc2fb93e7dc","resolution":{"observed_at":"2026-07-05T04:30:40.795499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T21:02:58.473863Z","title":null,"venue":null,"work_id":"e62e7afb-c170-4ab8-b162-c5b3b7f654e2","year":2024},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:0725f9ede8f98097ba1326ffbff1da5bfba095f6b030a59c92a0f7261f03c813","observation_id":"f6784373-2214-40bf-b0ee-c9bd478a8483","resolution":{"observed_at":"2026-07-05T04:30:40.765701Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:e8bf3f671ef366c6ca7056e6a90585b619317827e64bb89768b206ebd78a80c3","observation_id":"00006901-8916-495b-820d-1de76402ce36","resolution":{"observed_at":"2026-07-05T04:30:40.711472Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.790420Z","title":"In: Conference on Uncertainty in Artificial Intelligence (UAI) (2018)","venue":null,"work_id":"1fe18fcb-4bba-4afd-96b2-765fda36b6ea","year":2018},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:cd735f7bd1df6f47453e6db4b930c109a23c04643e209b15b58c6ffd8ddb4bf9","observation_id":"ad0da654-4a62-4028-ad7d-4a8914abbf2e","resolution":{"observed_at":"2026-07-05T04:30:40.791587Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.775342Z","title":"In: European Conference on Computer Vision","venue":null,"work_id":"47c181d7-20b9-474b-a52c-c71f9d387a19","year":2024},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:884e5676eaac61ae8d55fd4c3c158232fe951b4e13174589439e82ea203e6f80","observation_id":"24b0c639-6345-4d95-b90e-f5e8d9d5c459","resolution":{"observed_at":"2026-07-05T04:30:40.776516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.773708Z","title":null,"venue":null,"work_id":"10aa7f6f-0230-4f3a-969a-2043c6da3865","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:05a256eeb9f516744d7aa4d4d343b8c1e93485ac667a35b78fd95ee7b2f4becf","observation_id":"9961eb15-1d00-4465-a444-bee51d5833d0","resolution":{"observed_at":"2026-07-05T04:30:40.774990Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.771813Z","title":"In: Pro- ceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"da27ba57-6ce2-4d1f-bbbc-cb5b3f5b736e","year":2024},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:ba79f22a9940d3d9a3b46cafb8efb71225e881c2147928c063ef6b6880fefd6e","observation_id":"bc602f2e-42f5-4891-b2bf-c6fcd25bd9de","resolution":{"observed_at":"2026-07-05T04:30:40.773178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.792286Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"ef555d09-d276-49ab-8811-c2c66a6a3001","year":2023},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:dd9e213bac769da6d51fe447e23b621ebf107ccc2b307b2720cfe53ffae05447","observation_id":"6cfed8fd-c39a-4442-8d41-9152c0b1643e","resolution":{"observed_at":"2026-07-05T04:30:40.793806Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06769","last_updated":"2025-11-03T00:53:34Z","snapshot_observed_at":"2026-08-17T06:12:37.525438Z","submitted_at":"2024-12-09T18:55:56Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","version":3},"cited_work":{"arxiv_id":"2412.06769","doi":"10.48550/arxiv.2412.06769","metadata_source":"pith","pith_arxiv_id":"2412.06769","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Training Large Language Models to Reason in a Continuous Latent Space","venue":"cs.CL","work_id":"3ddd0fd2-c176-408f-9b58-0666c2707f2d","year":2024},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2412.06769","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:032c16466a32f01374e4a67f65f09e4edfaf8d4dcde4de891c0ba281594251ad","observation_id":"d1ba2e41-1e28-4985-aff9-42c11dc3399f","resolution":{"observed_at":"2026-07-05T04:30:40.734488Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-23T16:25:44.826594+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T16:25:44.826594+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.780871Z","title":"In: The Fourteenth International Conference on Learning Representations (2026)","venue":null,"work_id":"1c11cabf-f8e5-47f9-ae25-54ab8b7eb67a","year":2026},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:d51e86e4e06096a462ab13f6aff3362f1173f9832dc40cca0fad06657c1560ba","observation_id":"0a891123-77fc-4c2f-ac7b-1cc80d40adda","resolution":{"observed_at":"2026-07-05T04:30:40.782161Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.01006","last_updated":"2026-01-01T13:07:25Z","snapshot_observed_at":"2026-08-03T18:50:30.558321Z","submitted_at":"2025-07-01T17:55:04Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","version":6},"cited_work":{"arxiv_id":"2507.01006","doi":"10.48550/arxiv.2507.01006","metadata_source":"pith","pith_arxiv_id":"2507.01006","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GLM-4.5V and GLM-4.1V-Thinking: Towards Versatile Multimodal Reasoning with Scalable Reinforcement Learning","venue":"cs.CV","work_id":"366607ba-e4ea-4726-98c3-63356e32351c","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2507.01006","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:b03591237accaa46a88a45ea25003ab16ccee80fe597430aebfb73e637b80711","observation_id":"54642419-d86a-4860-8dc9-909ce3a9fa88","resolution":{"observed_at":"2026-07-05T04:30:40.733541Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-10T17:38:13.144769+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T17:38:13.144769+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-16T02:03:48.252223Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":"2503.06749","doi":"10.48550/arxiv.2503.06749","metadata_source":"pith","pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","venue":"cs.CV","work_id":"38998646-34ee-4605-b661-ab356f16d6e5","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:a38663c479f1772ceeb34da77d9a13cce4702c4443a7b4d8cbd7dc6d0ec4d502","observation_id":"936682d1-3f86-4243-948e-5afcf749f8e8","resolution":{"observed_at":"2026-07-05T04:30:40.691788Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-08-15T14:02:47.366139Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":"2410.21276","doi":"10.1177/15248380231178756","metadata_source":"pith","pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"GPT-4o System Card","venue":"cs.CL","work_id":"f37bf1c7-4964-4e56-9762-d20da8d9009f","year":2024},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:db7817537462ad9ae6c6545fe284ae1a2f2a175307ad07c66fdc8895dec721cf","observation_id":"ef3621f7-c7f8-4807-8cdc-0e01f961e3e6","resolution":{"observed_at":"2026-07-05T04:30:40.679378Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.763160Z","title":"In: The Fourteenth International Con- ference on Learning Representations (2026)","venue":null,"work_id":"49ed4b40-2c9c-4ec9-84ce-caa5892d251d","year":2026},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:5176450824a5454b55bd5ce311017944c54fa971b3948b47a6f982d6930fb1d5","observation_id":"a36b7e52-c3d0-48f0-9449-11418f9042e0","resolution":{"observed_at":"2026-07-05T04:30:40.764485Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.24251","last_updated":"2025-10-05T04:01:18Z","snapshot_observed_at":"2026-08-10T21:20:13.670725Z","submitted_at":"2025-09-29T03:52:01Z","title":"Latent Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2509.24251","doi":"10.48550/arxiv.2509.24251","metadata_source":"pith","pith_arxiv_id":"2509.24251","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Latent Visual Reasoning","venue":"cs.CV","work_id":"b6468cfa-4f13-4e02-b0ec-24ff5cd6785a","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2509.24251","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:67b609fd7cab03e69b7fab816658c6b9a00a0b60408b5436f302e448791bac52","observation_id":"373b0a68-5366-49e8-9c89-bb156f3a832e","resolution":{"observed_at":"2026-07-05T04:30:40.711286Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-08-18T11:56:50.710310Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":"2408.03326","doi":"10.48550/arxiv.2408.03326","metadata_source":"pith","pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","venue":"cs.CV","work_id":"f5f2452b-f2a9-49ac-b38d-c76e18cdfe49","year":2024},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:55444eb0ec74c6d74503674bde278881a461011d0396ad97c519f0dbe2cfa056","observation_id":"1dea6164-e378-48a2-9716-7e73851f0878","resolution":{"observed_at":"2026-07-05T04:30:40.718782Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.16790","last_updated":"2024-04-25T17:39:35Z","snapshot_observed_at":"2026-08-16T13:57:47.881881Z","submitted_at":"2024-04-25T17:39:35Z","title":"SEED-Bench-2-Plus: Benchmarking Multimodal Large Language Models with Text-Rich Visual Comprehension","version":1},"cited_work":{"arxiv_id":"2404.16790","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.16790","snapshot_observed_at":"2026-07-05T04:30:40.718071Z","title":"Seed-bench-2-plus: Benchmarking multimodal large language models with text-rich visual comprehension","venue":null,"work_id":"892bf722-73fc-4b2e-858d-e1dddc728b4c","year":2024},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2404.16790","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:e22ca95eba36acecb9ceec62f500265acc37aa8585f961c3d6727312430785da","observation_id":"b0fe877f-5bf5-449c-9e76-3a59ace3047f","resolution":{"observed_at":"2026-07-05T04:30:40.720043Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.799263Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":"968a95e4-a0fd-4fb1-95d5-26f7b0785c6f","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:b57b32b364f39d03e19a60ffa8ecc31ca949ac09b668d5f5e1a30a0908363490","observation_id":"7836e70b-9db4-4e10-9108-8fa130beebee","resolution":{"observed_at":"2026-07-05T04:30:40.800409Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.773416Z","title":"In: Forty-second International Conference on Machine Learning (2025)","venue":null,"work_id":"012614ba-b6bf-4d07-b8a6-de0d25801a44","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:be61a46350983b1ec62e5eb4738fbc951306c57d59dc36f2d5be19de4166b3fd","observation_id":"9101e9bf-dbf0-49a7-bb7a-db99654fca01","resolution":{"observed_at":"2026-07-05T04:30:40.774827Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.10941","last_updated":"2026-04-30T17:59:42Z","snapshot_observed_at":"2026-08-17T16:36:13.869490Z","submitted_at":"2025-12-11T18:59:08Z","title":"Mull-Tokens: Modality-Agnostic Latent Thinking","version":2},"cited_work":{"arxiv_id":"2512.10941","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.10941","snapshot_observed_at":"2026-07-10T13:37:06.836665Z","title":"Mull-Tokens: Modality-Agnostic Latent Thinking","venue":"cs.CV","work_id":"a831fe1f-0927-46d3-a512-9e9b3a906248","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2512.10941","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:6c6a4bf5f05598b43ec76c22306a63a74989c30dea9acf8fa40ebf3906c93a35","observation_id":"856175f0-622b-416c-808c-5d09a4456557","resolution":{"observed_at":"2026-07-05T04:30:40.730692Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-08-15T20:26:32.102285Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":"1707.06347","doi":"10.1016/j.artint.2010.12.005","metadata_source":"pith","pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Proximal Policy Optimization Algorithms","venue":"cs.LG","work_id":"240c67fe-d14d-4520-91c1-38a4e272ca19","year":2017},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:cfdab2ca30de9dbbf5b8691bbb40269d60c11b391bf903d95bc2eb9553e740df","observation_id":"4f5caa07-bd79-4da9-a81a-30b7fca46d4c","resolution":{"observed_at":"2026-07-05T04:30:40.729555Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":"2402.03300","doi":"10.1016/0004-3702(73)90011-8","metadata_source":"pith","pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","venue":"cs.CL","work_id":"c5006563-f3ec-438a-9e35-b7b484f34828","year":2024},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:88581527a762809f64f71853641e0d5f8fa452c2f4c69920a04f811bde3c1bdd","observation_id":"8a431597-9f55-4cd2-b523-1908608d0bf6","resolution":{"observed_at":"2026-07-05T04:30:40.703172Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.793990Z","title":"In: Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"cf3c6d6d-e4e9-4bf6-9e1b-257b4b7b79b4","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:e2c731029b422e3bfd8df221c7cdaf66bd6e06efec63efa373de9e3b558a8721","observation_id":"ccf6dadf-7e21-4b5b-b04e-bfe26e296bae","resolution":{"observed_at":"2026-07-05T04:30:40.795158Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.781065Z","title":"In: Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing","venue":null,"work_id":"41b2f1fd-b953-4228-94bc-b09e8a4e190b","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:dabe741ff9bbbe41219bedbed5c39f183fc14e0275f1847b87075f26d6883188","observation_id":"859e8b0c-ca89-401c-a70a-543dfc417e4e","resolution":{"observed_at":"2026-07-05T04:30:40.782322Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.17312","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.723609Z","title":"Codedance: A dynamic tool-integrated mllm for executable visual reasoning","venue":null,"work_id":"0c8c9b34-9988-431c-9bfc-f287be68abf7","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:90254fb4e897da82c7dcfe4bf5798d95e539d1fe682ec01322b568a7234e1f3d","observation_id":"3a1b2a12-983a-40d7-ae94-1ead6a6a0f62","resolution":{"observed_at":"2026-07-05T04:30:40.725089Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.16584","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.735725Z","title":"Sketch-in-latents: Eliciting unified reasoning in mllms.arXiv preprint arXiv:2512.16584","venue":null,"work_id":"46adadd8-c41c-4fc6-ada3-e996ed5f58c7","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:b5e0ba58fff81ddf916c34547ee32876aa8fb05491df832da8a883e3ddb0f825","observation_id":"030fd404-b7ee-469c-aa49-4d00a0c25d3c","resolution":{"observed_at":"2026-07-05T04:30:40.737246Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T18:21:23.288524Z","title":"In: Proceedings of the IEEE/CVF conference on computer vision and pattern recognition","venue":null,"work_id":"ff1643d8-7670-4d6f-bd92-41b87c2df284","year":2024},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:0842b8e5984399c10d828948e2734074b9a491cc70734468f3200ce5b03679ac","observation_id":"5012cf98-d126-4967-a474-bbbf81ae911f","resolution":{"observed_at":"2026-07-05T04:30:40.787952Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.14786","last_updated":"2025-02-20T18:08:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-20T18:08:29Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","version":1},"cited_work":{"arxiv_id":"2502.14786","doi":"10.48550/arxiv.2502.14786","metadata_source":"pith","pith_arxiv_id":"2502.14786","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features","venue":"cs.CV","work_id":"50eec732-2d41-432f-9dcf-ac7fff235ea5","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2502.14786","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:b86aeeea341ee96d9b5a8dac77c6f135e93a3ce36558556f6f1954823fb9f7ee","observation_id":"5e6ad73a-c99d-4ae5-8868-40dbf4742d65","resolution":{"observed_at":"2026-07-05T04:30:40.732212Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-07-10T23:49:08.777694+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T23:49:08.777694+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.08837","last_updated":"2025-05-08T06:35:06Z","snapshot_observed_at":"2026-08-17T11:15:45.055944Z","submitted_at":"2025-04-10T17:41:56Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","version":3},"cited_work":{"arxiv_id":"2504.08837","doi":"10.48550/arxiv.2504.08837","metadata_source":"pith","pith_arxiv_id":"2504.08837","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"VL-Rethinker: Incentivizing Self-Reflection of Vision-Language Models with Reinforcement Learning","venue":"cs.LG","work_id":"b13ff087-9614-48cc-8991-ad75b6543bbc","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2504.08837","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:ffe3bd16f0d369bc4c8a9114938600949f920c6689107c384b34fdff390fcf9b","observation_id":"8c7419ad-2aa9-4aaa-959e-b5f7e2a896a5","resolution":{"observed_at":"2026-07-05T04:30:40.705870Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.21395","doi":"10.48550/arxiv.2511.21395","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Monet: Reasoning in latent visual space beyond images and language","venue":"ArXiv.org","work_id":"ce4ac531-7907-4d8a-afe2-9a0dae21ffa5","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:a5ff6278be515da3501d42dcc235146e18394099831e4a3180e045e5714b04ef","observation_id":"8c8e5868-6830-48ff-9866-de8cdab442ae","resolution":{"observed_at":"2026-07-05T04:30:40.713815Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.777078Z","title":"In: International conference on ma- chine learning","venue":null,"work_id":"89ddb658-04eb-4c65-8eae-bbe210200c2a","year":2020},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:9e7b2e8e00d4e73ae82982cd28f05bf3eb8a9fcd3f44f4a3cd457b7f18802bd7","observation_id":"b59e923d-44b2-4e2c-bdf9-6e8d3938d51a","resolution":{"observed_at":"2026-07-05T04:30:40.778441Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18265","last_updated":"2025-08-27T14:39:45Z","snapshot_observed_at":"2026-08-17T12:32:16.575866Z","submitted_at":"2025-08-25T17:58:17Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","version":2},"cited_work":{"arxiv_id":"2508.18265","doi":"10.48550/arxiv.2508.18265","metadata_source":"pith","pith_arxiv_id":"2508.18265","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3.5: Advancing Open-Source Multimodal Models in Versatility, Reasoning, and Efficiency","venue":"cs.CV","work_id":"b8f5e260-fff5-444e-bcf5-2c42cfefd83d","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2508.18265","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:a88361c8167e3933230f0a2140e97c9ee758551499576b010d21cbe788ebbe09","observation_id":"8c13cd48-8560-4927-9b2e-369d3a302f6d","resolution":{"observed_at":"2026-07-05T04:30:40.702640Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-10T17:38:12.771444+00:00","source":"crossref_status_cache"},{"observed_at":"2026-08-10T17:38:12.771444+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.779075Z","title":"In: Proceedings of the AAAI Conference on Artificial Intelligence","venue":null,"work_id":"0209fa7f-1a95-4558-b14b-c9a8d66de0a4","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:8f2f74e475b6ff586bb6dec1ebabf7b73c0c829102729aebb846a99bff1f64c1","observation_id":"9e7a8ef8-71c5-408c-833b-02cf9ee09228","resolution":{"observed_at":"2026-07-05T04:30:40.780187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.06803","last_updated":"2026-04-20T09:04:42Z","snapshot_observed_at":"2026-08-11T12:24:59.401094Z","submitted_at":"2026-01-11T08:30:49Z","title":"Forest Before Trees: Latent Superposition for Efficient Visual Reasoning","version":2},"cited_work":{"arxiv_id":"2601.06803","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.06803","snapshot_observed_at":"2026-07-05T04:30:40.712657Z","title":"Forest Before Trees: Latent Superposition for Efficient Visual Reasoning","venue":"cs.CL","work_id":"6a365679-e46a-49c6-906a-725bab8c52a3","year":2026},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2601.06803","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:4f59332e1ab570d84f1216fb8218df35b7e1bba1c5087877f36b1ca34f7637b1","observation_id":"8e56df07-daf8-437e-93aa-4a31507523b0","resolution":{"observed_at":"2026-07-05T04:30:40.713808Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.795688Z","title":"In: The Fourteenth International Conference on Learning Representations (2026)","venue":null,"work_id":"ead915f6-6ebc-4f4f-accf-0e48f143ea7c","year":2026},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:8e25571fecf668f1bc42d11b976291c1ff420756c70e3a52ec18ce13db45d18a","observation_id":"ae8f3334-1981-4066-a248-15559c7f99ac","resolution":{"observed_at":"2026-07-05T04:30:40.796812Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.777685Z","title":"https://github.com/huggingface/trl(2020)","venue":null,"work_id":"1d70ca7d-a164-475e-83e0-7fc168d60f99","year":2020},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:283d341bd64672d2cfc18b25af4688b502848764616a9b293bcdea004d8fddf8","observation_id":"94f39f78-4a58-4a4f-a142-03b494c48ad5","resolution":{"observed_at":"2026-07-05T04:30:40.778839Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.796071Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition","venue":null,"work_id":"4ebfa7b9-511f-442a-ae90-37da0a162614","year":2024},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:771cf02bcad06d02e4952044ba3496c0e50cc3afe118629902a7aa2e6f01130f","observation_id":"66d923a6-f7d3-4eab-b37d-b579f06e6c59","resolution":{"observed_at":"2026-07-05T04:30:40.797268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.782921Z","title":"In: The Thirteenth International Conference on Learning Representations (2025)","venue":null,"work_id":"ba84684d-723b-41f8-bd35-1b35ed23d414","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:ff7e0f626605837ea24b138947c4fbce87f7fcca619d0e885906a2ea4aed8d43","observation_id":"d5b39e2e-74e8-407a-96fe-512caabb9ba4","resolution":{"observed_at":"2026-07-05T04:30:40.784167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17218","last_updated":"2025-06-20T17:59:31Z","snapshot_observed_at":"2026-08-13T03:28:19.590253Z","submitted_at":"2025-06-20T17:59:31Z","title":"Machine Mental Imagery: Empower Multimodal Reasoning with Latent Visual Tokens","version":1},"cited_work":{"arxiv_id":"2506.17218","doi":"10.48550/arxiv.2506.17218","metadata_source":"pith","pith_arxiv_id":"2506.17218","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Machine Mental Imagery: Empower Multimodal Reasoning with Latent Visual Tokens","venue":"cs.CV","work_id":"d35f1e96-5f12-4e84-990b-e4b05852180e","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2506.17218","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:aebb76f1ef5f2015b28831c2d3adccb283735076e9ef89dd86ace6651f5332a0","observation_id":"eaf0e5d4-9274-4335-b35c-4c0a6de31ea1","resolution":{"observed_at":"2026-07-05T04:30:40.700508Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.753384Z","title":"In: The Thirty-ninth Annual Conference on Neural Information Processing Systems (2025)","venue":null,"work_id":"f1de0666-b9fb-4e44-bdaf-e39aa6c50028","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:02e471df5c10201fba1ac556e88a5ac0b3af753d43ff20ac0fd1992097f927bd","observation_id":"b46b6b36-53b7-47a8-b35e-b0dfdb1788a3","resolution":{"observed_at":"2026-07-05T04:30:40.754694Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.784809Z","title":"Advances in neural information processing systems32(2019)","venue":null,"work_id":"9824a980-fa55-4bad-ae1b-7d89a5ac7062","year":2019},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:499aacf4b57e102fe6f40b2346d2fd1c220960dfae36ae1cfe5680d89aa6e258","observation_id":"ce56528a-5d66-4dce-b3e6-4e2e514215f3","resolution":{"observed_at":"2026-07-05T04:30:40.786074Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.11630","last_updated":"2025-08-15T17:59:49Z","snapshot_observed_at":"2026-08-16T04:57:28.480168Z","submitted_at":"2025-08-15T17:59:49Z","title":"Thyme: Think Beyond Images","version":1},"cited_work":{"arxiv_id":"2508.11630","doi":"10.48550/arxiv.2508.11630","metadata_source":"pith","pith_arxiv_id":"2508.11630","snapshot_observed_at":"2026-07-11T03:17:52.050556Z","title":"Thyme: Think Beyond Images","venue":"cs.CV","work_id":"f91f31cb-6ce5-43a8-b71e-9fc90a2b4160","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2508.11630","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:aad472ae29674968e54aca9d6c1a4e6937d1494d6a6e658d3c3d413728782f3e","observation_id":"68c6c86a-22b1-44c4-b417-29bf72738755","resolution":{"observed_at":"2026-07-05T04:30:40.724342Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.790563Z","title":"In: The Thirty- ninth Annual Conference on Neural Information Processing Systems (2025)","venue":null,"work_id":"86f8e686-efdf-4fe7-9c56-d13db023bba8","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:65d1d92f467e2ffe26a2f8d66af6b833281b551faee3d7c9e8640d5b3df95283","observation_id":"41be6412-306c-4edc-b310-d0311ff655bc","resolution":{"observed_at":"2026-07-05T04:30:40.791764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.00923","last_updated":"2024-05-20T06:43:48Z","snapshot_observed_at":"2026-08-11T00:52:12.225793Z","submitted_at":"2023-02-02T07:51:19Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","version":5},"cited_work":{"arxiv_id":"2302.00923","doi":"10.48550/arxiv.2302.00923","metadata_source":"pith","pith_arxiv_id":"2302.00923","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Multimodal Chain-of-Thought Reasoning in Language Models","venue":"cs.CL","work_id":"cf983328-0c5e-4840-8f51-2b24cf4b21ee","year":2023},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2302.00923","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:e3df8cf88699ef797d12ff6006b7d8fba6565c98061aebbb414f0d46351cfd65","observation_id":"08694fb4-b97b-4ec9-8c88-7477b0e84e8f","resolution":{"observed_at":"2026-07-05T04:30:40.726775Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12345","last_updated":"2025-01-21T18:23:42Z","snapshot_observed_at":"2026-08-17T21:47:45.862645Z","submitted_at":"2025-01-21T18:23:42Z","title":"The doubly librating Plutinos","version":1},"cited_work":{"arxiv_id":"2501.12345","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.12345","snapshot_observed_at":"2026-07-05T04:30:40.720029Z","title":"arXiv preprint arXiv:2501.12345 , year=","venue":null,"work_id":"216add13-ee85-43c4-845b-e6c521435fd8","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2501.12345","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:9fae33a1bdc414b4c96339c7f7ee5826dbd9c1510f8bb810a5f0b29c05f15fba","observation_id":"d4d554b7-b3ca-403a-bb12-c1498aa8eb20","resolution":{"observed_at":"2026-07-05T04:30:40.721609Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T04:30:40.797445Z","title":"thinking with images","venue":null,"work_id":"01b283a6-4a74-4526-975e-f8b9d28b5c9c","year":2026},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:cc0b85f83d88daf3b7a5f5eb34bc245424c33a4d71b3d6377dc0afe42bb89234","observation_id":"733123a0-736f-45f0-8936-3d4df8fc70cb","resolution":{"observed_at":"2026-07-05T04:30:40.798516Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-17T09:56:52.502317Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":"2504.10479","doi":"10.48550/arxiv.2504.10479","metadata_source":"pith","pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","venue":"cs.CV","work_id":"fe8637aa-12bc-4434-8d36-9f57b5eebcbe","year":2025},"citing_paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-07-05T04:29:52.480873Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2604.20328"},"observation_digest":"sha256:d80eda0109336364c4c466d45c88ef1803567f28c319c0d86b5b623dd9f39919","observation_id":"a98c9e18-aef8-4038-8b41-8794ab5b8f11","resolution":{"observed_at":"2026-07-05T04:30:40.722418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.20328","last_updated":"2026-06-26T07:09:02Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-16T04:36:04.017438Z","submitted_at":"2026-04-22T08:22:23Z","title":"HyLaR: Hybrid Latent Reasoning with Decoupled Policy Optimization"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":20,"parse_uncertain":0,"unresolved":2,"verified_exact":4,"verified_fuzzy":23},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 3 inbound Pith citation observations for arXiv:2604.20328."}