{"as_of":"2026-08-13T05:47:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:88c03f844865bee9ec7f2a78fe5d77098dc3397f9579891748bd6320fb80a673","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T03:20:41.241752Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.13931/citation-record","integrity":"/paper/2607.13931/integrity","json":"/paper/2607.13931/citation-record.json","paper":"/paper/2607.13931"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-02T03:20:41.069447Z","title":"arXiv preprint arXiv:2402.03300 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.069447Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:ed357f382845d9050dd96eb766837760dc357462f95336cf9944822210a3959a","observation_id":"0e874b72-8eed-4456-aae6-14333dc9388c","resolution":{"observed_at":"2026-08-02T03:20:41.069447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-02T03:20:41.075686Z","title":"arXiv preprint arXiv:2501.12948 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.075686Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:473ab9a7e63e393afe001b5277c014ce673c1b9479ad41924f630fb2cb901261","observation_id":"0e6669aa-5bce-441b-a7c8-406a04c220c6","resolution":{"observed_at":"2026-08-02T03:20:41.075686Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06749","last_updated":"2026-02-28T21:10:52Z","snapshot_observed_at":"2026-08-07T18:44:26.813869Z","submitted_at":"2025-03-09T20:06:45Z","title":"Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.06749","snapshot_observed_at":"2026-08-02T03:20:41.080183Z","title":"arXiv preprint arXiv:2503.06749 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.080183Z"},"links":{"cited_paper":"/paper/2503.06749","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:1bc415dee26c861198dc3398e2e9b5a516a20328cd16a9f851b7a33e892e4f2f","observation_id":"ec268e6a-fbca-434e-99a0-8c764a8fc3d6","resolution":{"observed_at":"2026-08-02T03:20:41.080183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16673","last_updated":"2025-05-22T13:39:32Z","snapshot_observed_at":"2026-08-07T14:55:04.641472Z","submitted_at":"2025-05-22T13:39:32Z","title":"R1-ShareVL: Incentivizing Reasoning Capability of Multimodal Large Language Models via Share-GRPO","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16673","snapshot_observed_at":"2026-08-02T03:20:41.084534Z","title":"arXiv preprint arXiv:2505.16673 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.084534Z"},"links":{"cited_paper":"/paper/2505.16673","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:a5a376bf86a27cecb89581453f4eba3ded341099f59b67e59dd134d06e83b824","observation_id":"06dcff5a-f3fd-44cc-b354-a1b8179ffeb8","resolution":{"observed_at":"2026-08-02T03:20:41.084534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07365","last_updated":"2025-04-15T14:22:45Z","snapshot_observed_at":"2026-08-09T01:06:58.674891Z","submitted_at":"2025-03-10T14:23:12Z","title":"MM-Eureka: Exploring the Frontiers of Multimodal Reasoning with Rule-based Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.07365","snapshot_observed_at":"2026-08-02T03:20:41.089080Z","title":"arXiv preprint arXiv:2503.07365 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.089080Z"},"links":{"cited_paper":"/paper/2503.07365","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:3745c5c31c82b61f011f1cbf7aa514b97d65b38a7117cb6f9f9322c2c046fefe","observation_id":"3a01ce91-20bb-4567-9162-45fec421330f","resolution":{"observed_at":"2026-08-02T03:20:41.089080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.093691Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.093691Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:0f7b25b9a2c740c1d807a8f427650808b706e45b5c5bddde3c40ae3d4c50f13c","observation_id":"23cd4394-cf7d-4f7a-b7de-d0ea9d71ec76","resolution":{"observed_at":"2026-08-02T03:20:41.093691Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.098234Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.098234Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:270f280061078a4760b028c364b6d3027f6b49e0c0369caf512ca395e3bc6830","observation_id":"58bfba63-0677-4203-8ce8-47278cb26ad3","resolution":{"observed_at":"2026-08-02T03:20:41.098234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.102162Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.102162Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:c5ce7689757bcb34ac14c1633b9555f9e1ff773cf4266064f0265aaefbb83898","observation_id":"93038a30-d193-4c47-b198-b678de52e9c3","resolution":{"observed_at":"2026-08-02T03:20:41.102162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.107069Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.107069Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:a504caa6e6c7be00d6948d096a1fe8376c61b8ae6dd4fb2010be54a2d81efc76","observation_id":"eebd00f9-9e48-4d19-b9a1-da1e3cc66184","resolution":{"observed_at":"2026-08-02T03:20:41.107069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.111376Z","title":"arXiv preprint arXiv:2505.14677 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.111376Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:3f4aba44a78d8f0595c6cf2d12e9387db10c63378d8ff624be2e66c20f6f5349","observation_id":"52f88b82-711d-432d-948b-3379d87541e4","resolution":{"observed_at":"2026-08-02T03:20:41.111376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.115488Z","title":"arXiv preprint arXiv:2506.07218 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.115488Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:30666df5aad6efa22ead7cd1de1e1ad3278300b1aa7c76d4449b3041fbbcda9a","observation_id":"82c3c017-6304-47c5-bbae-98c898eda726","resolution":{"observed_at":"2026-08-02T03:20:41.115488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.119447Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.119447Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:93642806e787b63cf4688d9197c5152fb081ce4e51cdfc5b4d0a93bb1015c421","observation_id":"37cd9f84-d5c6-4ae7-99ec-9f3df4ec3bf2","resolution":{"observed_at":"2026-08-02T03:20:41.119447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06448","last_updated":"2026-04-14T16:31:35Z","snapshot_observed_at":"2026-08-11T06:04:53.078032Z","submitted_at":"2025-07-08T23:22:34Z","title":"Perception-Aware Policy Optimization for Multimodal Reasoning","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2507.06448","snapshot_observed_at":"2026-08-02T03:20:41.123647Z","title":"arXiv preprint arXiv:2507.06448 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.123647Z"},"links":{"cited_paper":"/paper/2507.06448","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:f2075eb77e4b8e4c4a3b90c1ec237cf6a4aecb0b261b477d4aca1c3587b5b19b","observation_id":"16c75267-7b7e-4d91-8939-5c284401d55e","resolution":{"observed_at":"2026-08-02T03:20:41.123647Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.127728Z","title":"arXiv preprint arXiv:2510.09285 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.127728Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:5c5b9a96539d9202e9937636d23245479cbb8ed99fdf16586460e1f76131e2de","observation_id":"5a857210-39a5-4f1c-90db-cfc8e66b6613","resolution":{"observed_at":"2026-08-02T03:20:41.127728Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.09349","last_updated":"2026-05-22T04:26:00Z","snapshot_observed_at":"2026-08-11T15:26:19.366863Z","submitted_at":"2026-04-10T14:22:38Z","title":"Visually-Guided Policy Optimization for Multimodal Reasoning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.09349","snapshot_observed_at":"2026-08-02T03:20:41.131609Z","title":"arXiv preprint arXiv:2604.09349 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.131609Z"},"links":{"cited_paper":"/paper/2604.09349","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:18862490fdf193c4fa12997a1b610a6f2acd4363dcaafe91cdd22a80c74079b0","observation_id":"df2de53d-6001-4909-9b35-3c0a7693d870","resolution":{"observed_at":"2026-08-02T03:20:41.131609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.08708","last_updated":"2026-06-07T16:06:29Z","snapshot_observed_at":"2026-08-10T21:56:20.663743Z","submitted_at":"2026-06-07T16:06:29Z","title":"PRPO: Perception-Reinforced Policy Optimization via Token-Level Dynamic Advantage Reshaping","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.08708","snapshot_observed_at":"2026-08-02T03:20:41.136332Z","title":"arXiv preprint arXiv:2606.08708 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.136332Z"},"links":{"cited_paper":"/paper/2606.08708","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:c22806a07b782ed42370c45e70dfbb535b95a83d17334068b0b0f79074284a15","observation_id":"4e9af9d2-bf31-4dcb-87b6-d3754817e9f1","resolution":{"observed_at":"2026-08-02T03:20:41.136332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.140552Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.140552Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:624ab1aac97f358888739cfa3d1579a7135a996949948d84e92f7f279a0b1512","observation_id":"4b2f0927-3c86-4667-8ea6-39c3887b4fd1","resolution":{"observed_at":"2026-08-02T03:20:41.140552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.144244Z","title":"arXiv e-prints , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.144244Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:2d34c018e0f4a4d9d267543bebd0c40f54466811ea163928cc3f2bb37e596f87","observation_id":"c1da4876-3877-4c48-8a6d-edcaf33b5370","resolution":{"observed_at":"2026-08-02T03:20:41.144244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.17267","last_updated":"2025-06-10T20:20:05Z","snapshot_observed_at":"2026-08-07T19:59:20.205509Z","submitted_at":"2025-06-10T20:20:05Z","title":"CF-VLM:CounterFactual Vision-Language Fine-tuning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.17267","snapshot_observed_at":"2026-08-02T03:20:41.148082Z","title":"arXiv preprint arXiv:2506.17267 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.148082Z"},"links":{"cited_paper":"/paper/2506.17267","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:3531098276bc3c95c2006208c0f4a8cbd24cda255386a443bc11fba3730b94cb","observation_id":"03766e84-061f-41f4-9881-13016b986e34","resolution":{"observed_at":"2026-08-02T03:20:41.148082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.152152Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.152152Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:a0d6787ee6b995cbdd41094147bf5e3173432ebf87786733210f43ccb9137745","observation_id":"bade137f-4194-4dfc-bd1d-83c167505483","resolution":{"observed_at":"2026-08-02T03:20:41.152152Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.156053Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.156053Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:5ee1a1e081c6dcbf3efca8471f2c054a8e045c56b25bd92b25581b33f561673c","observation_id":"fccf4fab-38cf-48a1-aabc-a5b3c6b591c3","resolution":{"observed_at":"2026-08-02T03:20:41.156053Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.159748Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.159748Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:2c7188ca503cb5db9a18235542624f97b503d9e51449294c4771568b3a28b79b","observation_id":"6c87f0f3-be86-442d-a9a0-e1213ccbdff5","resolution":{"observed_at":"2026-08-02T03:20:41.159748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.163405Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.163405Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:93699fec22c8834641c27c78d5352c1f36fe86727fdf08f94fe76df545c55edb","observation_id":"23dabc44-cfef-43e4-9455-b34abf979ac4","resolution":{"observed_at":"2026-08-02T03:20:41.163405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.04973","last_updated":"2024-07-06T06:48:16Z","snapshot_observed_at":"2026-07-06T18:42:18.289966Z","submitted_at":"2024-07-06T06:48:16Z","title":"LogicVista: Multimodal LLM Logical Reasoning Benchmark in Visual Contexts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.04973","snapshot_observed_at":"2026-08-02T03:20:41.167563Z","title":"arXiv preprint arXiv:2407.04973 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.167563Z"},"links":{"cited_paper":"/paper/2407.04973","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:40285ceb3eb5dd0961ce8f906c6a0fa44c743653f01a230e79313b1a27168420","observation_id":"050cad7b-6532-42ee-a5b0-791759027144","resolution":{"observed_at":"2026-08-02T03:20:41.167563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.172208Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.172208Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:a29c84814d2f0be3e25546ce9bfd7eadafa777a77657c2d738c270e16bb7e16a","observation_id":"f0bdd938-5255-4b4a-9df9-04a530486cfc","resolution":{"observed_at":"2026-08-02T03:20:41.172208Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.175902Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.175902Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:630277caf25b3bc714b43653a0dfc756c6e4ddeecc2dcadc74cc2f593847961a","observation_id":"30e21131-e30c-4264-a60d-559dbcd68bb5","resolution":{"observed_at":"2026-08-02T03:20:41.175902Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.179957Z","title":"2024 , month = may, howpublished =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.179957Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:9cc6d144be00b313f988d66bb635abd8ca8ede139e4758cde2c49b5a47ea99f9","observation_id":"aa19fba9-2432-4f92-b33b-c042f3423469","resolution":{"observed_at":"2026-08-02T03:20:41.179957Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.183889Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.183889Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:117007ec786c3d83b7415abd9dae3cc39bdf521cfd1f25f1d746bdde1fa3f1cd","observation_id":"e55873ec-38b4-42b7-ac90-e3268fb95f9b","resolution":{"observed_at":"2026-08-02T03:20:41.183889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.187886Z","title":"2024 , month = dec, howpublished =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.187886Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:93c95658eef4df87ae0f1ad830ae004daaa987dfb6a45070dff06e557cb6db0c","observation_id":"e6afbab4-89b5-4b16-a117-d63251e86a9f","resolution":{"observed_at":"2026-08-02T03:20:41.187886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.191755Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.191755Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:cf7c038e50d1955731a5efddc6baf5e8c12b63c7ebd9f2de9ddb6cd9f779f42a","observation_id":"1e0d0e07-0b14-461d-8ecc-7f9e7bc05fbb","resolution":{"observed_at":"2026-08-02T03:20:41.191755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-02T03:20:41.195442Z","title":"arXiv preprint arXiv:2412.05271 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.195442Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:2579b75543032def3a86d106c0d7cb191e0913b6ee08e2fc8688375be5a83b75","observation_id":"2d25c3fe-f8cb-4c47-ab89-0e73e75513d3","resolution":{"observed_at":"2026-08-02T03:20:41.195442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-02T03:20:41.199785Z","title":"arXiv preprint arXiv:2408.03326 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.199785Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:ddb90e4dabf305b3e868f0227064fc19ce9de3704622be6ca708f7d4ed651123","observation_id":"51611e9f-0453-4014-a84a-a2a6033b3a52","resolution":{"observed_at":"2026-08-02T03:20:41.199785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.23661","last_updated":"2025-12-14T14:18:43Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-28T05:52:55Z","title":"LLaVA-OneVision-1.5: Fully Open Framework for Democratized Multimodal Training","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.23661","snapshot_observed_at":"2026-08-02T03:20:41.204065Z","title":"arXiv preprint arXiv:2509.23661 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.204065Z"},"links":{"cited_paper":"/paper/2509.23661","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:52340d751d9e076c8f693383969d35ca33b825b4e6e9c4191263153bc74faeb0","observation_id":"1695f712-e412-4c6f-af1d-00176ee54f5e","resolution":{"observed_at":"2026-08-02T03:20:41.204065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.00676","last_updated":"2025-08-31T03:08:02Z","snapshot_observed_at":"2026-08-12T20:40:34.244896Z","submitted_at":"2025-08-31T03:08:02Z","title":"LLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.00676","snapshot_observed_at":"2026-08-02T03:20:41.208153Z","title":"arXiv preprint arXiv:2509.00676 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.208153Z"},"links":{"cited_paper":"/paper/2509.00676","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:2bcd364049aa4b5d6bceb01aa7a8cc44dc2f0598704f1fb593d07953947d50b7","observation_id":"98c9f657-6b68-4eb6-8288-294bb38a9e9a","resolution":{"observed_at":"2026-08-02T03:20:41.208153Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.212250Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.212250Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:864d65e28ae68b54b82a6d8b087009345bfda12f8611bb04ebeb239bd38d1ddb","observation_id":"f0ca5672-f31d-48a6-b150-90da9a97faf1","resolution":{"observed_at":"2026-08-02T03:20:41.212250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.12504","last_updated":"2025-05-18T17:44:53Z","snapshot_observed_at":"2026-08-08T07:46:06.468510Z","submitted_at":"2025-05-18T17:44:53Z","title":"CPGD: Toward Stable Rule-based Reinforcement Learning for Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.12504","snapshot_observed_at":"2026-08-02T03:20:41.216453Z","title":"arXiv preprint arXiv:2505.12504 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.216453Z"},"links":{"cited_paper":"/paper/2505.12504","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:9c6bb938140c75912211687054c824a45e2c268b29a434e43efeb6824243a0f4","observation_id":"b5b0b13f-0f76-4cf7-99a4-62422ab98184","resolution":{"observed_at":"2026-08-02T03:20:41.216453Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.220552Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.220552Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:4e9d9a6279370cbf8846589a109af64ad0bc6728a9f69fa69fbc78e5764315a5","observation_id":"8eb62959-dc9a-4e5e-8da8-cd81bdc271bc","resolution":{"observed_at":"2026-08-02T03:20:41.220552Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.11468","last_updated":"2025-04-10T16:54:05Z","snapshot_observed_at":"2026-08-05T02:57:13.928237Z","submitted_at":"2025-04-10T16:54:05Z","title":"SFT or RL? An Early Investigation into Training R1-Like Reasoning Large Vision-Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.11468","snapshot_observed_at":"2026-08-02T03:20:41.224809Z","title":"arXiv preprint arXiv:2504.11468 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.224809Z"},"links":{"cited_paper":"/paper/2504.11468","citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:e8664f4fe8ee3f45149c5b7f49263ab59b38eabba571865baafba7d3edeb5d5f","observation_id":"3b2f3b5e-95e9-43e5-89b4-e24edf9eb807","resolution":{"observed_at":"2026-08-02T03:20:41.224809Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.229312Z","title":"arXiv preprint arXiv:2506.04559 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.229312Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:7591832f6e1d0ee393ceab12aacc0f580585ea4445704d9a32611018a138dcc3","observation_id":"8a3f002b-3c6f-45f7-8151-317c55b11046","resolution":{"observed_at":"2026-08-02T03:20:41.229312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.233432Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.233432Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:aae30306a330f1071150c4e69cab892f74423c1411fab6e11fda55e3158def40","observation_id":"576237ce-1c56-4d04-b8a5-eef74665169d","resolution":{"observed_at":"2026-08-02T03:20:41.233432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.237810Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.237810Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:68c6da8bf5f53298b24594a262d628c7621b4c813527dad92b9824c8785442f4","observation_id":"606a8c52-2679-4953-a487-9042aea00642","resolution":{"observed_at":"2026-08-02T03:20:41.237810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-02T03:20:41.241752Z","title":"arXiv preprint arXiv:2601.06801 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-02T03:20:41.241752Z"},"links":{"citing_paper":"/paper/2607.13931"},"observation_digest":"sha256:f87185cae690d3141e9780fad74c06aa05bc2ade5b6b0675474d5b7de3283830","observation_id":"93a670d9-fc5d-47b9-a957-a62cfc7364c6","resolution":{"observed_at":"2026-08-02T03:20:41.241752Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.13931","last_updated":"2026-07-15T15:13:02Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T19:04:33.731501Z","submitted_at":"2026-07-15T15:13:02Z","title":"SIVA-RL: Sensitivity-Invariance Visual Alignment for Multimodal Reinforcement Learning"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":42,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 13 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2607.13931."}