{"as_of":"2026-08-08T23:06:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ec6cfd06ee7f4a21e6dba084a8a62ca9418b93a2f1c04026b6a64a99aac40a7d","coverage":[{"denominator":119,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T10:07:32.605718Z","state":"measured"},{"denominator":100,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":100,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.20351/citation-record","integrity":"/paper/2607.20351/integrity","json":"/paper/2607.20351/citation-record.json","paper":"/paper/2607.20351"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:24.474755Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:24.474755Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:b95bc5c750a57b837324294e8aa3c48d5bbf7cae3fb0f5a0f2d58026227e0f72","observation_id":"94a586eb-2a86-46fd-87fb-c933a3872736","resolution":{"observed_at":"2026-08-01T10:07:24.474755Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:24.566866Z","title":"Proceedings of the IEEE International Conference on Computer Vision , pages =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:24.566866Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:e84ba756434a098c8a0e3f079c5b0a735ce0185dc58c82d38f23a18e93adae82","observation_id":"9d5b1027-32c8-4c0d-9dd0-9b8098a220ed","resolution":{"observed_at":"2026-08-01T10:07:24.566866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:24.678363Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:24.678363Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:8e1bb9419ac27982fa4cc7c288345ddbed5cb9ccb7c037b1183a466251fd7e43","observation_id":"3155600b-9060-4f32-bcc8-db093c4afa3e","resolution":{"observed_at":"2026-08-01T10:07:24.678363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:24.794477Z","title":"Advances in Neural Information Processing Systems , editor=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:24.794477Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:888d0e4f691f20dee529684034ff23bf991ce6b690e1e0af3f51397be1c9cb86","observation_id":"fcbe80e1-fa2b-4848-9285-865895e7ab00","resolution":{"observed_at":"2026-08-01T10:07:24.794477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1707.06347","last_updated":"2017-08-28T09:20:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-07-20T02:32:33Z","title":"Proximal Policy Optimization Algorithms","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.06347","snapshot_observed_at":"2026-08-01T10:07:24.907074Z","title":"arXiv preprint arXiv:1707.06347 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:24.907074Z"},"links":{"cited_paper":"/paper/1707.06347","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:729301752942b20b73dc8ee806e2e7975e456d8715f06ea3d65cfeb80274d1d5","observation_id":"55d0fb83-3bd8-4839-9b4c-31cc7809ecb5","resolution":{"observed_at":"2026-08-01T10:07:24.907074Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2001.08361","last_updated":"2020-01-23T03:59:20Z","snapshot_observed_at":"2026-07-06T08:52:12.656082Z","submitted_at":"2020-01-23T03:59:20Z","title":"Scaling Laws for Neural Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2001.08361","snapshot_observed_at":"2026-08-01T10:07:24.978082Z","title":"arXiv preprint arXiv:2001.08361 , year=","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:24.978082Z"},"links":{"cited_paper":"/paper/2001.08361","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:a00fdc76610fd1e7dfe7f24d37f4d09a9e8e9111773927070c56a829d3fa0492","observation_id":"bbd2ef52-2bc3-47d4-873d-95611e3848b4","resolution":{"observed_at":"2026-08-01T10:07:24.978082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2203.15556","last_updated":"2022-03-29T13:38:03Z","snapshot_observed_at":"2026-07-06T12:54:11.616335Z","submitted_at":"2022-03-29T13:38:03Z","title":"Training Compute-Optimal Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2203.15556","snapshot_observed_at":"2026-08-01T10:07:25.037331Z","title":"arXiv preprint arXiv:2203.15556 , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.037331Z"},"links":{"cited_paper":"/paper/2203.15556","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:4a676a36dfca9515ef8e9cd548bd27fdde479de130c7c5f23137a4998e30c55f","observation_id":"74b1b691-26e5-44ee-8667-4d3dfd3f5540","resolution":{"observed_at":"2026-08-01T10:07:25.037331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1712.00409","last_updated":"2017-12-01T17:13:14Z","snapshot_observed_at":"2026-07-06T06:12:18.811024Z","submitted_at":"2017-12-01T17:13:14Z","title":"Deep Learning Scaling is Predictable, Empirically","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.00409","snapshot_observed_at":"2026-08-01T10:07:25.137989Z","title":"arXiv preprint arXiv:1712.00409 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.137989Z"},"links":{"cited_paper":"/paper/1712.00409","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:f7512c48c2ff5ea9a449a6f6bb74a8318629f3e704c0da45eef594d29718b330","observation_id":"621d8276-1e48-47c6-9a49-abdd32aadddb","resolution":{"observed_at":"2026-08-01T10:07:25.137989Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:25.209194Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.209194Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:053a16105065ffdf7b16cfc14f66d6d06b0e0708f506dda371463c0ca0411455","observation_id":"bad5a3ac-1bbb-4060-962d-9c1bb1be0974","resolution":{"observed_at":"2026-08-01T10:07:25.209194Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:25.259319Z","title":"Proceedings of the National Academy of Sciences , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.259319Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:68cd86c30df071788cd9a01caa3aebf401e1b5fe18b00aed0e423b169fd6f8d7","observation_id":"18710306-afd2-4829-b8f7-465d80cd9ab4","resolution":{"observed_at":"2026-08-01T10:07:25.259319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:25.317075Z","title":"Journal of Machine Learning Research , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.317075Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:eef2159b18220f1986351ac0ed36a75f926c014cc7400a8d44c789147016d630","observation_id":"69f3604c-ddb2-4b46-8687-809ce284c75c","resolution":{"observed_at":"2026-08-01T10:07:25.317075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:25.427818Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.427818Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:59b9f100414e30a502a54cdf89d195ca4b414094615c31bebb3b80451fbf2194","observation_id":"6e9e0f2e-b7c1-4728-aa21-bcd650413e07","resolution":{"observed_at":"2026-08-01T10:07:25.427818Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:25.498814Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.498814Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:13993687c8f5bcb8c0d76cb5435cabf7293cb0952acb14d2929233210f24820b","observation_id":"26780d9d-7638-407f-bcb6-502872fa581f","resolution":{"observed_at":"2026-08-01T10:07:25.498814Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.07488","last_updated":"2026-07-03T02:02:48Z","snapshot_observed_at":"2026-08-06T03:56:30.954304Z","submitted_at":"2026-02-07T10:40:28Z","title":"Deriving Neural Scaling Laws from the statistics of natural language","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.07488","snapshot_observed_at":"2026-08-01T10:07:25.606783Z","title":"arXiv preprint arXiv:2602.07488 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.606783Z"},"links":{"cited_paper":"/paper/2602.07488","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:e4f28cf1a22d3242255046b0693e0ef73225adb99da3e91a5bc051119a5caed8","observation_id":"16a4e1ca-9a2c-46ec-95d1-46786c22edcb","resolution":{"observed_at":"2026-08-01T10:07:25.606783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:25.662643Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.662643Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:cce3f226da97228cab6631a2a328470c6ccef269bbad4172c867b99b14f44e52","observation_id":"4154713e-ea01-4595-a6dd-802f2ca4e6ea","resolution":{"observed_at":"2026-08-01T10:07:25.662643Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:25.728254Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.728254Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:dcc1c96fb6eb7f5cf50c9cff68fc60c626381c49661bd37337d5ef4dbb357a20","observation_id":"71d4a0e6-045e-427c-bde8-400565bb0ccf","resolution":{"observed_at":"2026-08-01T10:07:25.728254Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:25.837147Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.837147Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:8a46d077f885303f4d5163abbab5762ddcc9f96790a481b06d6696bf796bee9a","observation_id":"e3bcc5f4-9e26-47ea-be2e-701483fcdb5f","resolution":{"observed_at":"2026-08-01T10:07:25.837147Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:25.906688Z","title":"Proceedings of the International Conference on Learning Represenatations 2014 , year=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:25.906688Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:5a8bb64c37b0ad82b7bdf4b082dd35369a5db8ba2644899e1cf9697cf1ff24be","observation_id":"55815aac-1324-4905-92ac-e7f865eb44a0","resolution":{"observed_at":"2026-08-01T10:07:25.906688Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:26.014320Z","title":"Proceedings of the National Academy of Sciences , volume=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.014320Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:d9c1ac7c46c1264f9d9aaccfa73d3b8aae66d6efb2f579d834fef915891af44b","observation_id":"72f3018b-2698-4ef4-9e4f-ff9445349350","resolution":{"observed_at":"2026-08-01T10:07:26.014320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.02177","last_updated":"2022-01-06T18:43:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-01-06T18:43:37Z","title":"Grokking: Generalization Beyond Overfitting on Small Algorithmic Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.02177","snapshot_observed_at":"2026-08-01T10:07:26.083617Z","title":"arXiv preprint arXiv:2201.02177 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.083617Z"},"links":{"cited_paper":"/paper/2201.02177","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:9a9179812eb55d522fa9eaed8bd5f1b54f0d20718e28360cb3b9db90d21ba3de","observation_id":"1b4ded47-1fa1-4325-b962-d024d73bc2f3","resolution":{"observed_at":"2026-08-01T10:07:26.083617Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:26.143442Z","title":"Transactions on Machine Learning Research , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.143442Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:20081f5f7fb3766656ddd12ceb79cbe4d4d293c5842e50caa7dd714027f00a68","observation_id":"7d8b5c9d-832e-4c1a-9a00-571d840d536a","resolution":{"observed_at":"2026-08-01T10:07:26.143442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:26.194446Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.194446Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:3423e8b82e63d963c7b622693b1e5f2dd2844ec5cecf68ae4dd9fe545c18114a","observation_id":"dbf2ec57-8848-41eb-a714-3d69b861711f","resolution":{"observed_at":"2026-08-01T10:07:26.194446Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:26.295546Z","title":"Proceedings of the 41st International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.295546Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:f47a1d95dcfdac7e50ff6f47412b16e480816fc50778116d1eb087eaeb81d816","observation_id":"ba2a81fe-5544-4375-95cd-61655d725733","resolution":{"observed_at":"2026-08-01T10:07:26.295546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:26.356435Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.356435Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:05cfe34774495c9cda9af31e1c69255993853f07f7481493c44ca99d44c341c0","observation_id":"2e7871ca-67b0-469c-bf7a-875e08682525","resolution":{"observed_at":"2026-08-01T10:07:26.356435Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:26.428874Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.428874Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:5c76c23fe9b8a1b041e859cf77f6f569a2f62ee2e3bcb2b17e8ca1b0b1de0b19","observation_id":"33b79261-3801-4480-bf9a-87cc21fde6f8","resolution":{"observed_at":"2026-08-01T10:07:26.428874Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2602.15029","last_updated":"2026-06-29T19:57:33Z","snapshot_observed_at":"2026-08-07T20:51:49.710817Z","submitted_at":"2026-02-16T18:59:55Z","title":"Symmetry in language statistics shapes the geometry of model representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2602.15029","snapshot_observed_at":"2026-08-01T10:07:26.515576Z","title":"arXiv preprint arXiv:2602.15029 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.515576Z"},"links":{"cited_paper":"/paper/2602.15029","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:3ee866958f0390a288489b0a52fc362fd95de1e71f90edc96c048fe710342999","observation_id":"8582f203-6123-4d98-8059-b684d054f5ec","resolution":{"observed_at":"2026-08-01T10:07:26.515576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:26.623321Z","title":"The Twelfth International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.623321Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:0590b0b132b6e3e45b8cdb280b3d802abd382cad994f8c31c11e548b66ffcf1b","observation_id":"f6dea0a2-c815-44d2-9141-a2ff7cb6c8da","resolution":{"observed_at":"2026-08-01T10:07:26.623321Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.11895","last_updated":"2022-09-24T00:43:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-09-24T00:43:19Z","title":"In-context Learning and Induction Heads","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.11895","snapshot_observed_at":"2026-08-01T10:07:26.728719Z","title":"arXiv preprint arXiv:2209.11895 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.728719Z"},"links":{"cited_paper":"/paper/2209.11895","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:306af66ec1209f8d40a78d0ef7a37b9131efe20ece5f06ad94fea0df72726900","observation_id":"e90aa729-9005-4170-b6be-def199193421","resolution":{"observed_at":"2026-08-01T10:07:26.728719Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.10652","last_updated":"2022-09-21T20:49:26Z","snapshot_observed_at":"2026-07-06T13:54:56.779166Z","submitted_at":"2022-09-21T20:49:26Z","title":"Toy Models of Superposition","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.10652","snapshot_observed_at":"2026-08-01T10:07:26.793857Z","title":"arXiv preprint arXiv:2209.10652 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.793857Z"},"links":{"cited_paper":"/paper/2209.10652","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:e115b8135d11d542715dbd35fbcd3a81c100870f9b3a671b6458478047acdc30","observation_id":"8946bab3-ae34-4667-bb1f-7fcb5357ec16","resolution":{"observed_at":"2026-08-01T10:07:26.793857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:26.888976Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.888976Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:78e6c14872070e8c6f61846f5e36d1b2f71b6f3dddc457c837e984cc10cb34c6","observation_id":"1b8bebff-558f-46ac-945f-78a922e3b580","resolution":{"observed_at":"2026-08-01T10:07:26.888976Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:26.954190Z","title":"Findings of the Association for Computational Linguistics: EMNLP 2023 , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:26.954190Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:8b3fb44d32bcd4b1896cfc71cd1c326d9966047181b0a0021ecacddc7c56554d","observation_id":"c3551f6f-3f52-4fcb-934e-3dd8b80dba29","resolution":{"observed_at":"2026-08-01T10:07:26.954190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.011601Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.011601Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:e7326ae6911866f910dff8cc0e07fd414f8b41a2c48e2cf5c87fa335d362fcd1","observation_id":"c5471522-34ef-4628-a2c4-044660f7bec4","resolution":{"observed_at":"2026-08-01T10:07:27.011601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.062951Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.062951Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:eec0aa3d4bbbea9df287df07d4947831dab58a1062c11a1a71a3a297be18e55e","observation_id":"ceca64ca-b62c-4ac4-aecc-9c9a2157d0f4","resolution":{"observed_at":"2026-08-01T10:07:27.062951Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.159523Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.159523Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:ccac7734fa4a28cd86702770f308ad88cb6028671b3dda5846f9a618beb012f3","observation_id":"4a476cd6-58c8-42d7-8d20-2e1c0bcd4140","resolution":{"observed_at":"2026-08-01T10:07:27.159523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.227401Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.227401Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:4e7821ce01f05d4eb2d887b1ec5cf9c8299dfb24bb571c1868dd523dd61b53ac","observation_id":"9f52b9b0-b43a-40d1-9fc4-cc772abbbf47","resolution":{"observed_at":"2026-08-01T10:07:27.227401Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.319586Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.319586Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:bd4eb41b2add333bfa31b43d88d1af906e9ea454e7a0d0e8d341df57359789ea","observation_id":"8f9fc8c9-e2de-4d5c-bc4e-d89fe17c832b","resolution":{"observed_at":"2026-08-01T10:07:27.319586Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.381155Z","title":"Distill , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.381155Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:a55f1a74ec2930182770c8015b3094cd31941c571bef9961dd568698dcf58e13","observation_id":"98b24952-53eb-49b2-be09-6582b882c4d2","resolution":{"observed_at":"2026-08-01T10:07:27.381155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.423077Z","title":"Proceedings of the 2021 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.423077Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:fe9c7eca2343147cbe332164ff7b39edc98fe9a37a56793a6b4c86ac233f35be","observation_id":"36ccedaf-e325-470b-ac7b-3863e9686639","resolution":{"observed_at":"2026-08-01T10:07:27.423077Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.484345Z","title":"Transactions on Machine Learning Research , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.484345Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:0e783fd2c699b9aabf07a9b99cf9c92cc47825bdbb18ffef078d82d186a94dc2","observation_id":"835b26bf-a1ad-43c5-b262-054c08a5f7d4","resolution":{"observed_at":"2026-08-01T10:07:27.484345Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.538175Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.538175Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:858523d11f87780df279d6b804253db247c8efb42472f305aec59bab3478507a","observation_id":"2ef43189-f838-4a7c-9001-cd7a06d25a35","resolution":{"observed_at":"2026-08-01T10:07:27.538175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.01444","last_updated":"2017-04-06T09:48:20Z","snapshot_observed_at":"2026-07-06T05:36:39.612294Z","submitted_at":"2017-04-05T14:20:28Z","title":"Learning to Generate Reviews and Discovering Sentiment","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.01444","snapshot_observed_at":"2026-08-01T10:07:27.578366Z","title":"arXiv preprint arXiv:1704.01444 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.578366Z"},"links":{"cited_paper":"/paper/1704.01444","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:67198931abf3b5a602228ab683412a3fad715543fade766ca414f227d05ef212","observation_id":"e05fa544-9ff3-4eb4-aa8f-af3382b31f00","resolution":{"observed_at":"2026-08-01T10:07:27.578366Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.660191Z","title":"2023 , howpublished =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.660191Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:039b5ea9d750be3867f8f87efa12ee3b695497032695f4011b911176838297db","observation_id":"37910fd0-a010-4064-87be-f10b7680693f","resolution":{"observed_at":"2026-08-01T10:07:27.660191Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.744234Z","title":"International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.744234Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:96ddda670296a6d567f732ad268190d0e5edd7f4289201e87c0798b7f9ba25b2","observation_id":"a7cafaae-38e6-44d0-9270-0091d815cb52","resolution":{"observed_at":"2026-08-01T10:07:27.744234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.803315Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.803315Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:8dce39739aa05fe3907799b6004e6dd955e1e47e681bcf544e29514b13529c31","observation_id":"c01436c9-d06a-42e0-96fb-d8f416a3ba25","resolution":{"observed_at":"2026-08-01T10:07:27.803315Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.901126Z","title":"The Thirty-ninth Annual Conference on Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.901126Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:64c224a78a68e5b134a834bf3ec9070df2f9fdb68dbb25b3939bd32be5ede1db","observation_id":"d97ac13d-2a96-44ed-aa3d-3ca431a2f017","resolution":{"observed_at":"2026-08-01T10:07:27.901126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:27.965288Z","title":"The Thirteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:27.965288Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:6c38cd1af366a303cdcee8081b9dd7859b3c1df6ffc14d2dffda9669073b25a6","observation_id":"68f15881-ecf7-4011-ae8b-87a6e3ae012a","resolution":{"observed_at":"2026-08-01T10:07:27.965288Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.22594","last_updated":"2026-06-11T01:15:40Z","snapshot_observed_at":"2026-08-07T12:49:34.817408Z","submitted_at":"2026-01-30T05:41:19Z","title":"Language Model Circuits Are Sparse in the Neuron Basis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.22594","snapshot_observed_at":"2026-08-01T10:07:28.038378Z","title":"arXiv preprint arXiv:2601.22594 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.038378Z"},"links":{"cited_paper":"/paper/2601.22594","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:b2e396c40ccf3264e056b9610a878c40adb851767bce7d571aa0732c79196771","observation_id":"f2884873-6e2a-45f3-bb16-d9f231278cbb","resolution":{"observed_at":"2026-08-01T10:07:28.038378Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.116052Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.116052Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:adc4a124adaa352fbf88346ead4013baa13215fb6e35c6537dcee4b3720b3aef","observation_id":"2cc21393-46c2-41e0-b96a-862198b896a3","resolution":{"observed_at":"2026-08-01T10:07:28.116052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.179601Z","title":"Proceedings of the National Academy of Sciences , volume=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.179601Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:937292c41f6aadc240a0b29411beca76e035620fee977eb26f1288814be5a627","observation_id":"432bde18-8573-43e4-b0ee-aee374dfdc21","resolution":{"observed_at":"2026-08-01T10:07:28.179601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.238377Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.238377Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:5ee5d8d3aea9d650e06165858318ab7bb130f81102614656914334b06e81725a","observation_id":"4ecf2118-9280-4225-9034-c742326993eb","resolution":{"observed_at":"2026-08-01T10:07:28.238377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.284175Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.284175Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:680a91f545931728345d93197a2f5b80721adfff2eb77fc4aaaea4ceeaf65c4c","observation_id":"fa9b84e9-7f34-415f-bc74-07647818e225","resolution":{"observed_at":"2026-08-01T10:07:28.284175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.387487Z","title":"Hopcroft , title=","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.387487Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:6ec2396a8e0294c7941c1150d859143dbad5706d6d6fef994602c77bdb7e9edd","observation_id":"0e76f801-85db-49ec-84b7-b76e7a0d2b7c","resolution":{"observed_at":"2026-08-01T10:07:28.387487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.453487Z","title":"Forty-first International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.453487Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:eb1f11c4e7b01a82a10953b032d6f66095926d1c89c39c41c6e9d3fd9da9ab0b","observation_id":"951496f5-b31b-42a6-8300-3246f8da0cc1","resolution":{"observed_at":"2026-08-01T10:07:28.453487Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.554439Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.554439Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:198a6233b8b6ebf702548c836121e295a4d20e560bb99c5913ef71a4f4353d86","observation_id":"d60af26d-fc2c-4616-9a9c-fbbcafe43efa","resolution":{"observed_at":"2026-08-01T10:07:28.554439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.649171Z","title":"Nature , volume=","venue":null,"work_id":null,"year":1996},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.649171Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:d4bab1b7b9bdc4ae494845ecfe9c4a1eb2295dabfa122f2c173eb71413e27b5d","observation_id":"2d81be89-647a-4e05-b765-4133ed78dd47","resolution":{"observed_at":"2026-08-01T10:07:28.649171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.742036Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.742036Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:8829c31d6e3c14a27556ef16100b648ae29c06a33540a24545f5b79093a12944","observation_id":"3b887d6a-718d-4f32-8624-2890364a507b","resolution":{"observed_at":"2026-08-01T10:07:28.742036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.821981Z","title":"Proceedings of the national academy of sciences , volume=","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.821981Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:a0a76a9a8a85899d96ea59127ea0fe44ccb9ba4513da41aca63c7909b6c16630","observation_id":"9a8c0072-1d02-42c2-976b-650df3eba81a","resolution":{"observed_at":"2026-08-01T10:07:28.821981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.934812Z","title":"Frontiers in systems neuroscience , volume=","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.934812Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:7de57f4c7d197e7687a67a02dcf53718fa03ae16053821bd0827b3c221c25aa6","observation_id":"015a10a4-c849-47e4-a8de-d2b55ca3402f","resolution":{"observed_at":"2026-08-01T10:07:28.934812Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:28.994123Z","title":"Proceedings of the IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:28.994123Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:2dae02d094277f19e5119a6f94641636bc7fdadfa6dd09d54df32268224ffdb1","observation_id":"23dc7e45-9aee-45f3-8cf6-55a287cf8e34","resolution":{"observed_at":"2026-08-01T10:07:28.994123Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.075568Z","title":"Behavioral and brain sciences , volume=","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.075568Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:2e8fef8ec483b958644f7bce3f587fc64b22c708af8601354169d8f5aa8c4baa","observation_id":"06115e1b-f985-4362-957e-3d532dee461a","resolution":{"observed_at":"2026-08-01T10:07:29.075568Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.223081Z","title":"Neuron , volume=","venue":null,"work_id":null,"year":2008},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.223081Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:87f51c15fb432409f77c945b444b54ed442ed35c6e0b83b90ad3b82ae02760c7","observation_id":"679569b2-e2e4-4eeb-acb8-fb0cdfe5fd1a","resolution":{"observed_at":"2026-08-01T10:07:29.223081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.343813Z","title":"Science , volume=","venue":null,"work_id":null,"year":2001},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.343813Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:915091253cf9651785609320dcf2a36218c40b16058621591019f2d453e75d66","observation_id":"3516ceaf-ebb6-468d-aae3-503866cd21a2","resolution":{"observed_at":"2026-08-01T10:07:29.343813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.460031Z","title":"Journal of Neuroscience , volume=","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.460031Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:8fbd8c062b1cf18e9902811d5068ec0f50a3a4cfeb1c605c87def6cd8f778037","observation_id":"4ea6cbd7-3416-4819-a051-456a3a1fd0f1","resolution":{"observed_at":"2026-08-01T10:07:29.460031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.566998Z","title":"The Eleventh International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.566998Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:26546cb9d404999679f779ea7d3b5124e948a9f4225f0cebad51cdd621b29499","observation_id":"1f79cd76-64ae-453c-9bab-494e4d0d29d2","resolution":{"observed_at":"2026-08-01T10:07:29.566998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.651350Z","title":"Journal of Neuroscience , volume=","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.651350Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:dbee1e19333f1d1c57deb4a70c15e97d7fd41c0e613d37379a7c6d29faa02a83","observation_id":"263d99fa-bdf1-4b03-a8c3-8592855a5480","resolution":{"observed_at":"2026-08-01T10:07:29.651350Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.702553Z","title":"Forty-second International Conference on Machine Learning , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.702553Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:5224a4afa75e880589a8d4c64e83bbfe21baee5550acb2a2710a440e995351ef","observation_id":"372e0cc5-7394-4fd2-a291-6b6b967819e8","resolution":{"observed_at":"2026-08-01T10:07:29.702553Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.757203Z","title":"The Thirteenth International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.757203Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:58fedcb227b848de0f0760dbbed90ed4814551e62178980de79ab472ceb9ee4d","observation_id":"71ee9001-6276-4324-9a1d-2db8acd7f51e","resolution":{"observed_at":"2026-08-01T10:07:29.757203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03300","last_updated":"2024-04-27T15:25:53Z","snapshot_observed_at":"2026-08-06T14:58:42.911363Z","submitted_at":"2024-02-05T18:55:32Z","title":"DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03300","snapshot_observed_at":"2026-08-01T10:07:29.810724Z","title":"arXiv preprint arXiv:2402.03300 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.810724Z"},"links":{"cited_paper":"/paper/2402.03300","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:e98e878aa096d49be505ca7ededce9d2f8c0622f81898f0462dc8a31d5c7c8c2","observation_id":"c8689ca9-6c12-473c-84ad-7d6d703e2253","resolution":{"observed_at":"2026-08-01T10:07:29.810724Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.876527Z","title":"The Twelfth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.876527Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:317311180d3e076b60a0a3967756c9c0d2eb41c9b206a759c703cae8fc101cbc","observation_id":"9a28c0bf-7bc4-466d-a9e6-3b557f072a75","resolution":{"observed_at":"2026-08-01T10:07:29.876527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.916595Z","title":"2023 , journal=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.916595Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:c716a93436bbab960aeb1f53f4be3ca6883f79a9d3229a36c2cb36eb9625b895","observation_id":"399cef46-c63e-41ed-9a03-7980cec5f2fa","resolution":{"observed_at":"2026-08-01T10:07:29.916595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:29.965538Z","title":"Transactions of the Association for Computational Linguistics , volume=","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:29.965538Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:d84f104ca7cb8667ecf9886929fe26fa37c61185e60db03256148ce9827a3461","observation_id":"0312138e-151d-4d4c-a95a-a2971084170a","resolution":{"observed_at":"2026-08-01T10:07:29.965538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2101.00027","last_updated":"2020-12-31T19:00:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-12-31T19:00:10Z","title":"The Pile: An 800GB Dataset of Diverse Text for Language Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2101.00027","snapshot_observed_at":"2026-08-01T10:07:30.019326Z","title":"arXiv preprint arXiv:2101.00027 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.019326Z"},"links":{"cited_paper":"/paper/2101.00027","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:3c2d62cd04dc9ecebf0262bdd4e1564a848def10eadd1d9ab3d4bf45dd0267dc","observation_id":"c25cbadf-fea9-4040-a6e0-55f8882c932a","resolution":{"observed_at":"2026-08-01T10:07:30.019326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:30.070985Z","title":"2009 IEEE conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.070985Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:cad63a71a698241a5bd615b2bccd0045743ac946a6601984adeea6ddd5cf4cf6","observation_id":"97946cc9-0ad3-420e-8f78-6ae1df117ef0","resolution":{"observed_at":"2026-08-01T10:07:30.070985Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:30.122922Z","title":"OpenAI blog , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.122922Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:50b62e5650f5ca05febeb3f5a573cad6d672f731f4d13a671e030dc61bfdad53","observation_id":"7c3b94b1-4843-4056-a79f-fd01dc926a25","resolution":{"observed_at":"2026-08-01T10:07:30.122922Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:30.188423Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.188423Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:85cd9a2f62c9d9c1b23a30b09afeeb22e5915f2a6cc35613eee3ebc55984d174","observation_id":"a398e1ce-54e2-4310-91bb-54a03d2c66ab","resolution":{"observed_at":"2026-08-01T10:07:30.188423Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.01068","last_updated":"2022-06-21T17:04:40Z","snapshot_observed_at":"2026-08-06T03:13:37.403059Z","submitted_at":"2022-05-02T17:49:50Z","title":"OPT: Open Pre-trained Transformer Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.01068","snapshot_observed_at":"2026-08-01T10:07:30.223778Z","title":"arXiv preprint arXiv:2205.01068 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.223778Z"},"links":{"cited_paper":"/paper/2205.01068","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:57212d49bfd08993c8cf04acb6a5209283caf0c5c44a05a267bcd23133689980","observation_id":"a5a04318-4248-4383-a6b5-bda9a8cc5b17","resolution":{"observed_at":"2026-08-01T10:07:30.223778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:30.278252Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":77,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.278252Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:c7a8b65ecabe9fdd47d3c003ee3d0b2895f6823a09fd4555af9f1c7d6e223bcb","observation_id":"88bc14c6-6962-4a32-a82b-0f91d523efaa","resolution":{"observed_at":"2026-08-01T10:07:30.278252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:30.329409Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":78,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.329409Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:50422ea5bc1458bca657251825df7afb1bf16b98f20ac0fd4aa698fa99b8b15e","observation_id":"ba2093ac-0f83-4367-9b61-d07e82990d16","resolution":{"observed_at":"2026-08-01T10:07:30.329409Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:30.385312Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":79,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.385312Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:deb1c38e1a5b5b49ffa08f7e303b392bd96c04f88278ddc9973832a3a978545c","observation_id":"2438af5b-ac25-462c-9916-161ba799b65b","resolution":{"observed_at":"2026-08-01T10:07:30.385312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:30.454164Z","title":"Transactions on Machine Learning Research , issn=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":80,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.454164Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:17af7aaae81ff2d1998c81e57b4859f00c74bb72398ba60a736befecb13b3e82","observation_id":"e72adb65-4af3-471d-8570-e1ffe4e7f9d4","resolution":{"observed_at":"2026-08-01T10:07:30.454164Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:30.519274Z","title":"arXiv preprint arXiv:2512.15715 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":81,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.519274Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:ae5d92757097b79c170e08e079e1bb71d333e2763285df8a807b454c86f2f62e","observation_id":"9594570a-2e7d-4378-9a66-58bb2db09cd8","resolution":{"observed_at":"2026-08-01T10:07:30.519274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:30.553304Z","title":"Proceedings of the IEEE/CVF international conference on computer vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":82,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.553304Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:a629e79ddf3ebb450d9eae83d7cd752cb59f93f4bee9838b186e9772e06bc3c9","observation_id":"cc1f4275-8183-4753-bd14-388783ea7cf9","resolution":{"observed_at":"2026-08-01T10:07:30.553304Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.06005","last_updated":"2026-08-04T14:22:50Z","snapshot_observed_at":"2026-08-07T23:11:32.049688Z","submitted_at":"2026-04-07T15:39:45Z","title":"Disentangling MLP Neuron Weights in Vocabulary Space","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.06005","snapshot_observed_at":"2026-08-01T10:07:30.620461Z","title":"arXiv preprint arXiv:2604.06005 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":83,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.620461Z"},"links":{"cited_paper":"/paper/2604.06005","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:caec478aa6965a99c82d18ee37563869615cea3ed72d32f508e697c610ede50d","observation_id":"ebab3390-8d4b-4406-8e98-38cc76a3b372","resolution":{"observed_at":"2026-08-01T10:07:30.620461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.10104","last_updated":"2025-08-13T18:00:55Z","snapshot_observed_at":"2026-07-06T22:12:35.584339Z","submitted_at":"2025-08-13T18:00:55Z","title":"DINOv3","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.10104","snapshot_observed_at":"2026-08-01T10:07:30.725512Z","title":"arXiv preprint arXiv:2508.10104 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":84,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.725512Z"},"links":{"cited_paper":"/paper/2508.10104","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:20dbc99bddbdfd7f6aeda20f8fed5a39cf7ee3fb9725ddf32ae17a4fce985b6c","observation_id":"46c2f70f-e389-472e-8b2f-8ec2a033627f","resolution":{"observed_at":"2026-08-01T10:07:30.725512Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:30.878437Z","title":"Proceedings of the IEEE/CVF Winter Conference on Applications of Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":85,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:30.878437Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:660f238dfb0785d0465e49505e9b15eeaa797345ef9029bc006174b8e24d3c2b","observation_id":"1d3bfee4-cea2-4601-9df7-6e3a6c2f5e5f","resolution":{"observed_at":"2026-08-01T10:07:30.878437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:31.043978Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":86,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:31.043978Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:01108efd97c6fdea6be31c09491cbc407bf8d38280f2b052ec9640c1e577eed8","observation_id":"31f309f2-e3e6-470d-80d1-fe9cb4767a70","resolution":{"observed_at":"2026-08-01T10:07:31.043978Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:31.206624Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":87,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:31.206624Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:9bca41caf9e435f63684ab04534b78323de9a7c0777f5d1b173e0eaab0c74d31","observation_id":"0ae3742b-e089-4500-bc03-a37fb530336c","resolution":{"observed_at":"2026-08-01T10:07:31.206624Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:31.431588Z","title":"Proceedings of the IEEE/CVF conference on computer vision and pattern recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":88,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:31.431588Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:96eff603f2bd2f6500f05a9af0956e62b8cb945a87e9f08f30af281e49eda585","observation_id":"9afe5036-c5f7-43a6-9dcd-7b3d36a754b0","resolution":{"observed_at":"2026-08-01T10:07:31.431588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-01T10:07:31.599891Z","title":"arXiv preprint arXiv:2511.21631 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":89,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:31.599891Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:36eca316896ee218241faec77a23ffc1981d41195b66589b0126f8eadb41eba7","observation_id":"630e4917-2c6d-4787-a63f-1b93a811222e","resolution":{"observed_at":"2026-08-01T10:07:31.599891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:31.772805Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":90,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:31.772805Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:63ea39d18e4376518e1a79d115e4b2cdb53009c8a7964e05805768c0cd854b95","observation_id":"16b4e4ff-446c-41df-9035-68adad34d72a","resolution":{"observed_at":"2026-08-01T10:07:31.772805Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:31.828355Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":91,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:31.828355Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:1efa495e52c0a67ad6a9e1823e2381e89b9885ec866523ba3f557289600f3a0f","observation_id":"2a50a917-2ec4-4760-94f7-856d5b04cc3a","resolution":{"observed_at":"2026-08-01T10:07:31.828355Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:31.890052Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":92,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:31.890052Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:a46b206634075d6a9480d049ebf700b5ff93d5b3d1477d0ba2ee9848d985b813","observation_id":"cf441157-8eba-4d19-9943-18a7e4010de8","resolution":{"observed_at":"2026-08-01T10:07:31.890052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:32.050791Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":93,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:32.050791Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:6583bf5a53f35ba6156452dfd3e97a00be77955369ab9e54911fb4aba9f76f98","observation_id":"04a0902a-a65e-4bc5-89b2-638bb23a09e6","resolution":{"observed_at":"2026-08-01T10:07:32.050791Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:32.144165Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":94,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:32.144165Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:6bcf0c47798578d9fff948f77f49e6a1cbb99a9764aec3f4e52294572ca4ed59","observation_id":"c88fc3bd-72a5-46c5-aea2-d4b9c9c90ed0","resolution":{"observed_at":"2026-08-01T10:07:32.144165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:32.203307Z","title":"International conference on machine learning , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":95,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:32.203307Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:8ce4fb2fe811eb6fb2c9813c04c955d57dcea5cff81598a6c7d7a66aa7b3ee38","observation_id":"5e3d6d36-bbb9-4080-b55b-b782ab0fac4c","resolution":{"observed_at":"2026-08-01T10:07:32.203307Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.10726","last_updated":"2021-03-18T17:58:01Z","snapshot_observed_at":"2026-07-06T09:30:32.320227Z","submitted_at":"2020-06-18T17:55:28Z","title":"Tent: Fully Test-time Adaptation by Entropy Minimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.10726","snapshot_observed_at":"2026-08-01T10:07:32.340275Z","title":"arXiv preprint arXiv:2006.10726 , year=","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":96,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:32.340275Z"},"links":{"cited_paper":"/paper/2006.10726","citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:b79bd0f8b218ca0a1c3bc5625a7bb2b8321b8478739bb3945185329d71fb44d3","observation_id":"8e87b7d1-fbbc-4a75-b7d2-3c7cb6e7987a","resolution":{"observed_at":"2026-08-01T10:07:32.340275Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:32.356502Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":97,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:32.356502Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:804e6f7286d0420b5a0a1a24d6dedc511e0f712e1e7e6c15622f2ee3712595d6","observation_id":"d5ba5e07-614b-46b7-81ac-19664047de6f","resolution":{"observed_at":"2026-08-01T10:07:32.356502Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:32.410405Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":98,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:32.410405Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:44995b75ace02814de8ff914b4bd70a04cd84399e99ee47e1445523f516ff545","observation_id":"4e75ca72-a20d-440e-89b4-9835df57620d","resolution":{"observed_at":"2026-08-01T10:07:32.410405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:32.535588Z","title":"arXiv preprint arXiv:2510.14242 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":99,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:32.535588Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:9b678b7a71004caf5ee12ebfcf01fc9f46a8ee2d29b20e00bca2212e5e0d62de","observation_id":"49ef105c-ae66-4596-a7b8-46723af6a88e","resolution":{"observed_at":"2026-08-01T10:07:32.535588Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T10:07:32.605718Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models","version":1},"reference_index":100,"source":"arxiv_source","source_observed_at":"2026-08-01T10:07:32.605718Z"},"links":{"citing_paper":"/paper/2607.20351"},"observation_digest":"sha256:cd430ffb00712a9a9fea5ba205f31dcd56d7b446ac0205e95a933163eb587c2f","observation_id":"76c8f885-d0ce-41ea-8177-93cdd5a82ddb","resolution":{"observed_at":"2026-08-01T10:07:32.605718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.20351","last_updated":"2026-07-22T16:37:02Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T04:52:48.990256Z","submitted_at":"2026-07-22T16:37:02Z","title":"Test-Time Training for Modality Order Consistency in Vision-Language Models"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":100,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":119},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 100 of 119 outbound references and 0 inbound Pith citation observations for arXiv:2607.20351."}