{"as_of":"2026-08-11T12:17:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:43fa17f79beaa01d2b3d17a0a0e1b786d04361fc72dad90539460e8fcba9793b","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-30T10:38:22.619277Z","state":"measured"},{"denominator":83,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":83,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T02:13:11.938873Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.02564","snapshot_observed_at":"2026-08-01T02:13:11.938873Z","title":"VLMs are good teachers for video reasoning via adaptive test-time optimization.arXiv preprint arXiv:2606.02564, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25537","last_updated":"2026-07-28T10:18:58Z","snapshot_observed_at":"2026-08-08T23:11:18.983142Z","submitted_at":"2026-07-28T10:18:58Z","title":"Visual prompt engineering for video models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T02:13:11.938873Z"},"links":{"cited_paper":"/paper/2606.02564","citing_paper":"/paper/2607.25537"},"observation_digest":"sha256:1aed1eaca42ee231c6dfa1fb1eda0b8f58be314731581553c1dd28356e718dd3","observation_id":"0668deb4-1aad-42da-b63c-07be808d368b","resolution":{"observed_at":"2026-08-01T02:13:11.938873Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.02564/citation-record","integrity":"/paper/2606.02564/integrity","json":"/paper/2606.02564/citation-record.json","paper":"/paper/2606.02564"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.215226Z","title":"Sora: Openai’s text-to-video model,","venue":null,"work_id":"4882c404-986e-43cc-a3aa-b7d1735a639a","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:46b6c16215fade8bd02d25604f9dd08f54b5731afa1133147f49efdf484f6ae5","observation_id":"5a2fa8c7-61f6-4b38-ae2a-31187f5485ff","resolution":{"observed_at":"2026-07-09T13:16:16.216709Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.14148","last_updated":"2026-04-15T17:59:40Z","snapshot_observed_at":"2026-08-11T10:01:39.973258Z","submitted_at":"2026-04-15T17:59:40Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","version":1},"cited_work":{"arxiv_id":"2604.14148","doi":"10.48550/arxiv.2604.14148","metadata_source":"pith","pith_arxiv_id":"2604.14148","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Seedance 2.0: Advancing Video Generation for World Complexity","venue":"cs.CV","work_id":"ceac4ea4-1ca6-4fe9-8324-880c07aec27d","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2604.14148","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:4d435030859a3415d1cfa2f2ce54ddd9f4368da9790855bc47efa6aafb349d15","observation_id":"df3ae0ed-6b8b-46a7-8275-2f5ebfeadd13","resolution":{"observed_at":"2026-06-30T10:44:36.779852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.183783+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.183783+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":"2503.20314","doi":"10.1109/19.492748","metadata_source":"pith","pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","venue":"cs.CV","work_id":"ad3ebc3b-4224-46c9-b61d-bcf135da0a7c","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:af6f425b9e6fcb0775570af8b49b89c825ba5b24df485c13b4730914a614af5d","observation_id":"622bcf36-6bb3-4297-a3cc-b22d6688253d","resolution":{"observed_at":"2026-06-30T10:44:36.772082Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.04570","last_updated":"2026-04-07T09:55:11Z","snapshot_observed_at":"2026-07-30T01:17:08.732833Z","submitted_at":"2025-11-06T17:25:23Z","title":"Thinking with Video: Video Generation as a Promising Multimodal Reasoning Paradigm","version":2},"cited_work":{"arxiv_id":"2511.04570","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.04570","snapshot_observed_at":"2026-07-10T01:46:40.976623Z","title":"Thinking with Video: Video Generation as a Promising Multimodal Reasoning Paradigm","venue":"cs.CV","work_id":"b327f866-d49b-4e15-aa3f-68b695fc7e47","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2511.04570","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:8ebb8bb692538634a333de8f69b4c621cf1daaf74aaebd66c7cfb68be926bd61","observation_id":"e574146b-899b-42f2-95b0-b6c82a161f70","resolution":{"observed_at":"2026-06-30T10:44:36.835287Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.26802","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.958177Z","title":"Are video models ready as zero-shot reasoners? an empirical study with the mme-cof benchmark","venue":null,"work_id":"9b88873e-00b7-4c70-91a0-59d9c610d094","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:9db1a2d8e13d61f1efdd39acc31376b47c7f33645603bb5cfc6bb29e3e6e4978","observation_id":"9d02e978-32b1-4e9d-9df2-7d149f67a710","resolution":{"observed_at":"2026-06-30T10:44:36.832891Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":"2210.02747","doi":"10.1038/s41467-024-47656-z","metadata_source":"pith","pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Flow Matching for Generative Modeling","venue":"cs.LG","work_id":"6edb71c4-5d64-40af-a394-9757ea051a36","year":2022},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:c111a0643ca34a31fd6c7f3d1803250cfeda69ca4f2a4f09cd1cc9045ad37d2a","observation_id":"24c078e5-54b2-410e-9357-bfcbc492cb9d","resolution":{"observed_at":"2026-06-30T10:44:36.792383Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:57:59.860918+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.268003Z","title":null,"venue":null,"work_id":"0973e693-3e47-4d04-b720-4204a615fb09","year":2006},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:d964c33a2fe3be52cd7d5c7af645415182ce278635dd533072f0f84abc724bd5","observation_id":"a407398a-a8a4-40fa-a16f-6b1b61e21558","resolution":{"observed_at":"2026-07-09T13:16:16.269187Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.30043","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:26:17.253424Z","title":"Video models reason early: Exploiting plan commitment for maze solving,","venue":null,"work_id":"8df7cd90-b636-46fe-9db1-7ae506e2b5b1","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:3b414c16657a7f3d0cc54091e7d715549f88a5e4a4309d392fdc7d1efc8c01f7","observation_id":"b0840d1f-42bd-44c0-8618-b1a7428c19c0","resolution":{"observed_at":"2026-06-30T10:44:36.797446Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.08735","last_updated":"2026-05-09T06:39:17Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-05-09T06:39:17Z","title":"CollabVR: Collaborative Video Reasoning with Vision-Language and Video Generation Models","version":1},"cited_work":{"arxiv_id":"2605.08735","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.08735","snapshot_observed_at":"2026-07-01T22:26:17.343064Z","title":"CollabVR: Collaborative Video Reasoning with Vision-Language and Video Generation Models","venue":"cs.CV","work_id":"71fac5f5-e92e-41de-a993-5379b845093d","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2605.08735","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:e11fd94e826136b21b1c75aaad4dc2ac231ad0f593e539f946023bb9ed70969f","observation_id":"14a746e8-15b1-4688-bed2-edcefb425a13","resolution":{"observed_at":"2026-06-30T10:44:36.787534Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.13704","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.961230Z","title":"arXiv preprint arXiv:2511.13704 , year=","venue":null,"work_id":"43eb1254-d612-4d1c-8e0e-b7a05936c90d","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:9fdb76ecb3d9cab0e5f3503a4f01d83f070e2074bd442a0b1155ffa8df4b88fb","observation_id":"51ef78b7-f091-4243-bd50-ccc4ea019782","resolution":{"observed_at":"2026-06-30T10:44:36.790002Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.16669","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-02T11:56:55.408495Z","title":"arXiv preprint arXiv:2511.16669 , year=","venue":null,"work_id":"83ba3b22-5b64-486b-9e96-d8ec7c89962d","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:5de9c0db524af80fcae4d6081ebcd5488583ebd47496f90c2f21bf348470a8fd","observation_id":"35d6a021-b51d-49c9-872d-514c85372ff3","resolution":{"observed_at":"2026-06-30T10:44:36.767125Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.266263Z","title":"Lora: Low-rank adaptation of large language models","venue":null,"work_id":"80ea7ed3-28ac-495a-80b6-eead54793b2d","year":2022},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:b4c41aa2752900dabf358b9d3739b57c2ffb908cf2ebc0c1d33fb2803f9ff1da","observation_id":"dfb1f9f1-2e1a-4432-bbab-dd308b928e20","resolution":{"observed_at":"2026-07-09T13:16:16.267470Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.20159","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.917858Z","title":"A very big video reasoning suite","venue":null,"work_id":"4cb52917-7539-4575-a350-92645383c4ef","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:412f332a220d5b9bcb7917ca0373591997548e901b7856f89171a7cead622cc9","observation_id":"a2c75988-ad05-4032-a963-5674dd0776c9","resolution":{"observed_at":"2026-06-30T10:44:36.769740Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.02622","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.955512Z","title":"Ruler-bench: Probing rule-based reasoning abilities of next-level video generation models for vision foundation intelligence","venue":null,"work_id":"6a5f46c0-ed59-4bf5-94f1-c9a715134a78","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:f1294ff3899a11300bbe20788f5732e321e281e51fcdd01eecd874700639012e","observation_id":"d9a28caa-ad9a-4c37-82d9-3f1cab962ede","resolution":{"observed_at":"2026-06-30T10:44:36.777391Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.257347Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":"c4cf16f1-ef0e-46ca-b395-41b305598794","year":2020},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:3e38398a422f8f393bef9d4db94df1f935c814536f53ac9819b4e21158f64504","observation_id":"03485d67-da83-4cf9-ae76-b395e2a1373a","resolution":{"observed_at":"2026-07-09T13:16:16.258550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.246262Z","title":"Scalable diffusion models with trans- formers,","venue":null,"work_id":"9eee9e4d-cfc9-42ec-a587-9d08d831cf0b","year":2023},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:ddcfc2136ece75e75f26300fd55263749a2aaab8908ecb098f846888fa212845","observation_id":"f76dfe5a-055e-4e9e-8482-b6884179adbd","resolution":{"observed_at":"2026-07-09T13:16:16.247404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.249695Z","title":"Motiondiffuse: Text-driven human motion generation with diffusion model,","venue":null,"work_id":"92ced629-9013-4781-86a8-e6aeb89de7df","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:8a3a61c7cd54445ce68d892a52e42dcf09548e73d7e070f78851513e9945196e","observation_id":"1b455d70-6016-400a-93e6-7534c910b243","resolution":{"observed_at":"2026-07-09T13:16:16.250957Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13720","last_updated":"2025-02-26T16:05:55Z","snapshot_observed_at":"2026-08-10T21:41:31.247717Z","submitted_at":"2024-10-17T16:22:46Z","title":"Movie Gen: A Cast of Media Foundation Models","version":2},"cited_work":{"arxiv_id":"2410.13720","doi":"10.48550/arxiv.2410.13720","metadata_source":"pith","pith_arxiv_id":"2410.13720","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Movie Gen: A Cast of Media Foundation Models","venue":"cs.CV","work_id":"a6a118b0-002f-4b19-881f-7f1183e0d7d8","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2410.13720","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:2b9dc1b09cd9c45523f9da8fdba3e131865de82cbcd399c32bae0fb6a970836f","observation_id":"3edddad3-9a20-4a86-8dfd-239324a462ec","resolution":{"observed_at":"2026-06-30T10:44:36.794880Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.269825Z","title":"Veo 3.1,","venue":null,"work_id":"5f3ba52c-56d7-41b1-bd6c-a23397899527","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:39e32f6d9a6bd9ee81800ced97b5dbf563401bc33de275b1ba7b7b4277e88b22","observation_id":"117c5523-37b5-42f2-a964-a1bbddf04972","resolution":{"observed_at":"2026-07-09T13:16:16.270861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09113","last_updated":"2025-06-28T11:58:23Z","snapshot_observed_at":"2026-08-09T02:36:54.979612Z","submitted_at":"2025-06-10T17:56:11Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","version":2},"cited_work":{"arxiv_id":"2506.09113","doi":"10.48550/arxiv.2506.09113","metadata_source":"pith","pith_arxiv_id":"2506.09113","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Seedance 1.0: Exploring the Boundaries of Video Generation Models","venue":"cs.CV","work_id":"b2e36b5d-99e4-45b4-9358-64f6d3501983","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2506.09113","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:9ec7c72fac53345767f5032e834d219ece6036ffcca0761fcd8335f9bda9dad6","observation_id":"364255a2-df29-48f6-aed3-827cbf2f0eb4","resolution":{"observed_at":"2026-06-30T10:44:36.764583Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.13507","last_updated":"2025-12-23T17:38:46Z","snapshot_observed_at":"2026-08-10T07:54:14.758787Z","submitted_at":"2025-12-15T16:36:52Z","title":"Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model","version":3},"cited_work":{"arxiv_id":"2512.13507","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.13507","snapshot_observed_at":"2026-07-10T01:46:40.967365Z","title":"Seedance 1.5 pro: A Native Audio-Visual Joint Generation Foundation Model","venue":"cs.CV","work_id":"02efb197-4e2b-4141-8587-21b92ad92f08","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2512.13507","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:614d79e05558316ce74b8cfbf9e77aca22ea12f312997b25b122946fc36dd69b","observation_id":"b99d2df6-a381-4f4e-9bbe-e844073b73ad","resolution":{"observed_at":"2026-06-30T10:44:36.759022Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.06072","last_updated":"2025-03-26T08:33:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-12T11:47:11Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","version":3},"cited_work":{"arxiv_id":"2408.06072","doi":"10.48550/arxiv.2408.06072","metadata_source":"pith","pith_arxiv_id":"2408.06072","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer","venue":"cs.CV","work_id":"f38fc088-12aa-4bf4-9ecd-08d3e797ccb7","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2408.06072","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:479d96ff4e66623c50547aa63379cccd88b44ef117e60bf743ce7213f8ecb651","observation_id":"5bd0b46a-0b1e-459d-be15-d28b1f3e4a0c","resolution":{"observed_at":"2026-06-30T10:44:36.809274Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":"2412.03603","doi":"10.48550/arxiv.2412.03603","metadata_source":"pith","pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","venue":"cs.CV","work_id":"881efa7e-7e73-4c66-9cc3-2803e551061c","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:a810251c381978dac7e1d79508c92ae5c6429624586b892e4a16f1068f96c106","observation_id":"275e9e24-2158-44b2-a29b-f437e612f0ae","resolution":{"observed_at":"2026-06-30T10:44:36.851284Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-10T21:18:49.433177+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20404","last_updated":"2024-12-29T08:52:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-29T08:52:49Z","title":"Open-Sora: Democratizing Efficient Video Production for All","version":1},"cited_work":{"arxiv_id":"2412.20404","doi":"10.48550/arxiv.2412.20404","metadata_source":"pith","pith_arxiv_id":"2412.20404","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Open-Sora: Democratizing Efficient Video Production for All","venue":"cs.CV","work_id":"8b29ba7b-3d84-4281-85b7-9eaf905afd7f","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2412.20404","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:c39629f9d30bddceb37505f00a209220ff0953dcb6659ab208918e601292abf1","observation_id":"b087e749-a045-450c-b9db-470310e0685e","resolution":{"observed_at":"2026-06-30T10:44:36.753689Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.240699Z","title":"VBench++: Comprehen- sive and versatile benchmark suite for video generative models,","venue":null,"work_id":"c1d1bab6-dbc7-4fff-a2cd-50f53e4c0bf5","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:87f5878777eeb571d394d1b1919b2c8e7faa2fa1eb061f3122fa6e097a6b4775","observation_id":"c7613c32-de15-4a65-9b8c-368a5dd4464d","resolution":{"observed_at":"2026-07-09T13:16:16.241882Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":"2501.03575","doi":"10.48550/arxiv.2501.03575","metadata_source":"pith","pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Cosmos World Foundation Model Platform for Physical AI","venue":"cs.CV","work_id":"a2dba24c-318d-476a-8b21-4289c265810c","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:153c1f1037548d6ba26cda88e2ec5208a3695a6947d55b0fc14df86d408f8c00","observation_id":"32142a1a-3426-4ebd-8db3-d29d6ae8d294","resolution":{"observed_at":"2026-06-30T10:44:36.811680Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:29.560535+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.23656","last_updated":"2025-05-29T17:06:44Z","snapshot_observed_at":"2026-08-10T08:33:11.089931Z","submitted_at":"2025-05-29T17:06:44Z","title":"VideoREPA: Learning Physics for Video Generation through Relational Alignment with Foundation Models","version":1},"cited_work":{"arxiv_id":"2505.23656","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.23656","snapshot_observed_at":"2026-07-04T16:59:58.033217Z","title":"arXiv preprint arXiv:2505.23656 (2025)","venue":null,"work_id":"d810b0fc-7ae5-44e9-bd6e-bf39477b57a2","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2505.23656","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:d8764218300cc4a5178855503cb4d2dd0a82b276f6dc4c37ec24aba7cdf543b2","observation_id":"41590636-0f5c-4401-8ca2-229780b66fb2","resolution":{"observed_at":"2026-06-30T10:44:36.814378Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08153","last_updated":"2025-03-11T08:10:03Z","snapshot_observed_at":"2026-08-10T19:42:40.509462Z","submitted_at":"2025-03-11T08:10:03Z","title":"WISA: World Simulator Assistant for Physics-Aware Text-to-Video Generation","version":1},"cited_work":{"arxiv_id":"2503.08153","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08153","snapshot_observed_at":"2026-07-04T13:19:51.064913Z","title":"Wisa: World simulator assistant for physics-aware text-to-video generation","venue":null,"work_id":"faa75e3b-50f4-44b5-bfe5-65f0dc911f7e","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2503.08153","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:c9afac1bd3592018db990571db4278b46762af826af8aec53b628788125b7e0b","observation_id":"c8ff8407-e7a4-47da-8347-731ba78d530f","resolution":{"observed_at":"2026-06-30T10:44:36.751338Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2502.03639","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:26:17.225404Z","title":"Towards physical understanding in video generation: A 3d point regularization approach,","venue":null,"work_id":"f2c589d7-ffd1-4d6b-8e50-27f384dc8ad9","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:1b63a9c2abcfc0f70e56418e2e71415b95e9dedb14d2448ea1fa0ff101a93c29","observation_id":"d18345d4-1910-4619-94ee-46522b58482a","resolution":{"observed_at":"2026-06-30T10:44:36.756367Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.242437Z","title":"Phyt2v: Llm-guided iterative self-refinement for physics-grounded text-to-video gen- TECHNICAL REPORT 13 eration,","venue":null,"work_id":"02d4641f-1254-4b97-b793-7f7426d9d309","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:d46402ec448651d02f39249eefcb291fc995ca6b5e1ea062bc58f6f4a175dd63","observation_id":"8c7a2bda-205f-42fd-aa82-4477059e6694","resolution":{"observed_at":"2026-07-09T13:16:16.243871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.244452Z","title":"Physdreamer: Physics-based interaction with 3d objects via video generation,","venue":null,"work_id":"7cdbf4fa-3d2b-4708-90a2-0e0d2062c494","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:e205a3d1f8d43e52e189bf4213ae7ce5574d28db17a6c06a4f8dc692ce1f91cd","observation_id":"70840a70-1a89-4112-916a-1121188a7c13","resolution":{"observed_at":"2026-07-09T13:16:16.245713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.247914Z","title":"Physgen: Rigid- body physics-grounded image-to-video generation,","venue":null,"work_id":"536287ab-5809-4961-a53f-6fafe91f60da","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:9de2e7791a9eb47357cbc3dbd2fbe158def6df8989012647b87264cb00bc579f","observation_id":"7fb2f6b0-633b-45e7-9781-5d0fc4af74b1","resolution":{"observed_at":"2026-07-09T13:16:16.249088Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.08261","last_updated":"2025-02-16T03:13:51Z","snapshot_observed_at":"2026-08-10T20:15:15.341448Z","submitted_at":"2024-12-11T10:17:00Z","title":"FLIP: Flow-Centric Generative Planning as General-Purpose Manipulation World Model","version":2},"cited_work":{"arxiv_id":"2412.08261","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.08261","snapshot_observed_at":"2026-07-04T13:39:51.163883Z","title":"Flip: Flow-centric generative planning as general-purpose manipulation world model","venue":null,"work_id":"339ba8ff-0845-4be8-8f61-865696fae960","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2412.08261","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:704833f99c5488c713c629bc4cd6d8d6595684524f6eb3275c8f8266c5913888","observation_id":"d3f6ff42-94a8-4b30-bbd2-b3e871c46145","resolution":{"observed_at":"2026-06-30T10:44:36.762035Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.251920Z","title":"Physanimator: Physics- guided generative cartoon animation,","venue":null,"work_id":"ff5f179c-0a61-4cd6-9974-46624938bb87","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:27e2b8e7dfa451e9549197920a48c111cefeaf88443ff69ed371a5b52904f79a","observation_id":"8ac8ee76-331f-4870-958a-0b29d6df242d","resolution":{"observed_at":"2026-07-09T13:16:16.253185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.253740Z","title":"Motioncraft: Physics-based zero-shot video genera- tion,","venue":null,"work_id":"a9aada0f-4097-4dbf-b386-ed60f9dcc821","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:97027529afa190b1eefd26ab7426d5ef3c67dd92a701c7844c61713f623f804f","observation_id":"666f42e0-a5f3-403c-bdc2-fead69cd7f24","resolution":{"observed_at":"2026-07-09T13:16:16.254965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2512.05564","last_updated":"2026-04-12T02:52:57Z","snapshot_observed_at":"2026-07-06T22:37:50.431948Z","submitted_at":"2025-12-05T09:39:26Z","title":"ProPhy: Progressive Physical Alignment for Dynamic World Simulation","version":2},"cited_work":{"arxiv_id":"2512.05564","doi":null,"metadata_source":"pith","pith_arxiv_id":"2512.05564","snapshot_observed_at":"2026-07-03T19:28:52.392697Z","title":"ProPhy: Progressive Physical Alignment for Dynamic World Simulation","venue":"cs.CV","work_id":"629e6cc8-d174-4ac8-865f-5f1ac17e6f4e","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2512.05564","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:3942099937128c658a5e218943c9f8eda5da739eaa7478087eb96d9a3b50ab72","observation_id":"11d8ba6e-86b8-41fe-89f2-2c3e1440bad1","resolution":{"observed_at":"2026-06-30T10:44:36.774617Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.255513Z","title":"MagicTime: Time-lapse video generation models as metamorphic simulators,","venue":null,"work_id":"69084c3a-38e8-4d87-81e5-09bce5dfdb18","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:0e8d92399f2c255d69e607f3d4d21978f66f4176fe6ea458e721693f9dbc9377","observation_id":"b26f6c7c-b431-4a6b-ba84-c5792dcdcf64","resolution":{"observed_at":"2026-07-09T13:16:16.256774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.13853","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.964095Z","title":"Can world simulators reason? Gen-ViRe: A generative visual reasoning benchmark","venue":null,"work_id":"04240c59-0a34-48a6-8ca3-26dde22f21bb","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:5dd90bb15878cbcce588e7d1f83a5a63812d4449eb21cfb36cf8c38d7bbfaa7f","observation_id":"78fdce5f-376a-420d-8d8c-78a1f6190846","resolution":{"observed_at":"2026-06-30T10:44:36.784916Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.20328","last_updated":"2025-09-29T20:44:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-24T17:17:27Z","title":"Video models are zero-shot learners and reasoners","version":2},"cited_work":{"arxiv_id":"2509.20328","doi":"10.48550/arxiv.2509.20328","metadata_source":"pith","pith_arxiv_id":"2509.20328","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Video models are zero-shot learners and reasoners","venue":"cs.LG","work_id":"6ef44b1c-944f-4648-b3a3-e5c320f385c1","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2509.20328","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:0f15a7a092c72f951fc24cc7ff06a883deaeb50e43b38e4a6be6eec85e2d9725","observation_id":"997a36fb-569a-42a8-b392-62f02be18087","resolution":{"observed_at":"2026-06-30T10:44:36.802140Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:32.351277+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:32.351277+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.276762Z","title":"Chain-of-thought prompting elicits reasoning in large language models","venue":null,"work_id":"160fd536-c3a8-4b81-a56d-3f79bb308577","year":2022},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:4a41c339aab798b49c70d443ae93761b147a2d36a127fbb9a309994734424330","observation_id":"121abd1f-75c9-45b2-b55c-fbc99c161212","resolution":{"observed_at":"2026-07-09T13:16:16.278041Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.20194","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.980081Z","title":"Mme-cof-pro: Evaluating reasoning coherence in video generative models with text and visual hints.arXiv preprint arXiv:2603.20194, 2026","venue":null,"work_id":"01338b42-dd2a-449a-9aa3-ef5e8bf282c1","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:e13c11bad1a413069f9351d5e13e8099fdc52de32a99620f84a88b631e8c0bda","observation_id":"f0134a95-3feb-4039-92fe-fed81733d72c","resolution":{"observed_at":"2026-06-30T10:44:36.858653Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.16870","last_updated":"2026-07-31T08:55:01Z","snapshot_observed_at":"2026-08-05T23:10:24.488750Z","submitted_at":"2026-03-17T17:59:55Z","title":"Demystifying Video Reasoning","version":3},"cited_work":{"arxiv_id":"2603.16870","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.16870","snapshot_observed_at":"2026-07-01T22:26:17.260644Z","title":"Demystifing video reasoning","venue":"cs.CV","work_id":"3c1e0496-b6e9-481a-bced-29c25a6ed25f","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2603.16870","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:1010b9d0679ef1d104680c972bf395073dca852d42be764388efc4b60da38f31","observation_id":"522a6245-66ba-4160-b948-fb59ee29d99c","resolution":{"observed_at":"2026-06-30T10:44:36.848444Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.15065","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.947716Z","title":"Reasoning via video: The first evaluation of video models’ reasoning abilities through maze-solving tasks","venue":null,"work_id":"f545bb0a-f733-4043-b88d-269bb91de46a","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:7111832378b219857245fdbddfbf1f655814e36414b0967ac5e93105c0c39b2b","observation_id":"2913a767-29ff-4d2b-946d-8c264269f546","resolution":{"observed_at":"2026-06-30T10:44:36.840804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2512.14691","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.949924Z","title":"Mmgr: Multi-modal generative reasoning","venue":null,"work_id":"a0c3f635-dfea-4dbc-8c13-bf10cab2777c","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:1f941e307d56596e719d892c0e1c677aebfface2a538845be00af4d642b3884f","observation_id":"49d4c909-9060-4831-97af-b6330ca43f6c","resolution":{"observed_at":"2026-06-30T10:44:36.830231Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.16668","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.952974Z","title":"V-reasonbench: Toward unified reasoning benchmark suite for video generation models","venue":null,"work_id":"3984f3bb-30d6-40f2-abef-6f2bd8429945","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:0dd3eaaada4c8f3e4625691651804a0d81ee1b1d5f85d18799e314d16f9e33af","observation_id":"d156c6ed-f222-411d-a930-ae4b607b426a","resolution":{"observed_at":"2026-06-30T10:44:36.782394Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.24427","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T22:26:17.264538Z","title":"Ui2v-bench: An understanding- based image-to-video generation benchmark,","venue":null,"work_id":"2f661273-0428-4e24-8509-53aeed39569d","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:2222eed57dd3bb735b2dba5bf2a06a26461872f2328e76caef213b13730d6cfc","observation_id":"651f20ac-579d-421a-8af1-827746dee51d","resolution":{"observed_at":"2026-06-30T10:44:36.799948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.19193","last_updated":"2026-04-21T08:04:02Z","snapshot_observed_at":"2026-08-11T08:26:21.610628Z","submitted_at":"2026-04-21T08:04:02Z","title":"How Far Are Video Models from True Multimodal Reasoning?","version":1},"cited_work":{"arxiv_id":"2604.19193","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.19193","snapshot_observed_at":"2026-07-02T20:57:23.153286Z","title":"How Far Are Video Models from True Multimodal Reasoning?","venue":"cs.CV","work_id":"c3ac5465-7bcb-45d5-bf3f-ae38c0075362","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2604.19193","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:d636de0d7810bef719776752fc8f9ee05980d4451e88f59c7ff7828fe8beeaf3","observation_id":"856341ca-efa8-4bab-a6bb-7b1eeec1c6ec","resolution":{"observed_at":"2026-06-30T10:44:36.838077Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03314","last_updated":"2024-08-06T17:35:05Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:35:05Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","version":1},"cited_work":{"arxiv_id":"2408.03314","doi":"10.18653/v1/2025.acl-long.1486","metadata_source":"pith","pith_arxiv_id":"2408.03314","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Scaling LLM Test-Time Compute Optimally can be More Effective than Scaling Model Parameters","venue":"cs.LG","work_id":"a8d50b24-bdf5-46ed-bc4f-2927dfd81f1d","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2408.03314","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:1c6ef27e42a20a45ac77871c0ef31891fada495b2b0c94f18a6c516905b8d6e0","observation_id":"e26b1b27-2671-47b7-bf4d-68e37e734898","resolution":{"observed_at":"2026-06-30T10:44:36.843471Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21787","last_updated":"2024-12-30T19:03:24Z","snapshot_observed_at":"2026-07-06T18:55:11.576666Z","submitted_at":"2024-07-31T17:57:25Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","version":3},"cited_work":{"arxiv_id":"2407.21787","doi":"10.48550/arxiv.2407.21787","metadata_source":"pith","pith_arxiv_id":"2407.21787","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Large Language Monkeys: Scaling Inference Compute with Repeated Sampling","venue":"cs.LG","work_id":"b124064d-5a56-42ad-86f5-3cc349b86a3a","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2407.21787","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:ffa82c9a8e05818449aec6f7594b916c212f5e3803fb37cad328449faa8b7351","observation_id":"bdc52e84-8923-4458-8fcb-e942866f9e42","resolution":{"observed_at":"2026-06-30T10:44:36.845977Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-12T02:20:41.492703+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.278616Z","title":"Inference-time scaling for diffusion models beyond scaling denoising steps,","venue":null,"work_id":"5219f603-0e46-4db9-8231-cf469bfdb7fd","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:d1bab5bd47e5ba0b0dba912c2d37c60c59c9abf435168e702369a9a47a5ffe69","observation_id":"deecfa7b-19c2-41d5-a114-d0b8a95fafbe","resolution":{"observed_at":"2026-07-09T13:16:16.279857Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.259091Z","title":"Video-t1: Test-time scaling for video generation,","venue":null,"work_id":"c3411ebb-ae81-4d7c-af67-f57cafea3cb5","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:20866c9aeb1a88e72387062b508e2ff55a251beaa8eb3c1cfbb3555e5372ad35","observation_id":"90a80798-1126-4b9a-9c8c-834e6acb913e","resolution":{"observed_at":"2026-07-09T13:16:16.260233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.17618","last_updated":"2025-05-23T08:25:46Z","snapshot_observed_at":"2026-08-09T16:32:39.912773Z","submitted_at":"2025-05-23T08:25:46Z","title":"Scaling Image and Video Generation via Test-Time Evolutionary Search","version":1},"cited_work":{"arxiv_id":"2505.17618","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.17618","snapshot_observed_at":"2026-07-04T13:09:50.730002Z","title":"arXiv preprint arXiv:2505.17618 , year =","venue":null,"work_id":"57c6e091-57ae-40da-abcb-41b78bd60702","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2505.17618","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:0cbd1bce40e03a88e3f1de8e7c65d2c5bb0a5cb00c3caecd69961e87368124a7","observation_id":"7fe8fd98-52e1-4ba1-a3ac-e79dde3036f7","resolution":{"observed_at":"2026-06-30T10:44:36.861793Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.260767Z","title":"Can test-time scaling improve world foundation model?","venue":null,"work_id":"2b88df18-e024-4c3b-b66c-62b67ce06f86","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:462bf150b87f0eb7cbb793e8616182e8f925af8e954aa9a99c2b3913e6a91906","observation_id":"7cdb1d7b-0caa-4497-b63e-a74babd6ed57","resolution":{"observed_at":"2026-07-09T13:16:16.262068Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.21037","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:46:40.987714Z","title":"Thinking in frames: How visual context and test-time scaling empower video reasoning","venue":null,"work_id":"8a65d73d-2c1b-47a2-972d-45a14aa7ad25","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:cb48724b3302dec7821acc2f05b7af4143aea6cf65dd7e44b909a10c4358bfda","observation_id":"0643ccb8-94a9-4f53-a37a-6ef5a5d8c70b","resolution":{"observed_at":"2026-06-30T10:44:36.819799Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2601.18577","last_updated":"2026-05-20T05:19:37Z","snapshot_observed_at":"2026-07-06T22:43:02.453697Z","submitted_at":"2026-01-26T15:22:27Z","title":"Self-Refining Video Sampling","version":2},"cited_work":{"arxiv_id":"2601.18577","doi":null,"metadata_source":"pith","pith_arxiv_id":"2601.18577","snapshot_observed_at":"2026-07-03T10:27:56.798308Z","title":"Self-Refining Video Sampling","venue":"cs.CV","work_id":"0d3f3ea1-00a0-4713-ade0-aacd3961dc9f","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2601.18577","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:fa58a4e00af48b39a9678d93870eabf35424595b4a0538aff182eda37806c6a4","observation_id":"196cbccb-f30f-4709-8d8d-2a87670a68ed","resolution":{"observed_at":"2026-06-30T10:44:36.822055Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.262600Z","title":"Vision-language models for vision tasks: A survey,","venue":null,"work_id":"107425ee-6c87-40f9-bc03-db42415857a0","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:d0280bf363114e67fc8efeddc79759cc40d60dc1b3258cf4f73edfbff2765b08","observation_id":"9f5c8cc6-dfcf-4bdd-bb50-fddf0d2cbdec","resolution":{"observed_at":"2026-07-09T13:16:16.263797Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.264343Z","title":"Otter: A multi-modal model with in-context instruction tuning,","venue":null,"work_id":"07de9906-9931-4eba-8c3a-3023d642c9a0","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:cb9d41bfe4e02c3b8e94f54070e20145236bec3c030976cf60b19ff4e6e80f7f","observation_id":"38db3d05-259b-4c26-98fe-997325f2bdfd","resolution":{"observed_at":"2026-07-09T13:16:16.265647Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.273154Z","title":"Cross-modal causal relational reasoning for event-level visual question answering,","venue":null,"work_id":"29872eb5-3860-49ad-97fa-4957f30f7847","year":2023},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:6e6ffeca29649c628507ccdddafb0f9173aac1345a5300139c19af6421783c3c","observation_id":"ac11893b-d790-474a-b3e8-987d86eb8331","resolution":{"observed_at":"2026-07-09T13:16:16.274358Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.271455Z","title":"Language-aware spatial-temporal collaboration for referring video segmentation,","venue":null,"work_id":"6a309e53-edbd-4761-a0f9-9264735cd571","year":2023},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:5bfa81d913662cd274ec37cbb5b977f9bba83eafaa2886f1d59f903d54c8120f","observation_id":"34b7b977-7bcd-4530-b598-0117550aa64b","resolution":{"observed_at":"2026-07-09T13:16:16.272597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.21374","last_updated":"2025-05-27T16:05:01Z","snapshot_observed_at":"2026-08-06T04:32:21.352745Z","submitted_at":"2025-05-27T16:05:01Z","title":"Video-Holmes: Can MLLM Think Like Holmes for Complex Video Reasoning?","version":1},"cited_work":{"arxiv_id":"2505.21374","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.21374","snapshot_observed_at":"2026-07-04T16:39:58.338552Z","title":"Video-Holmes: Can MLLM Think Like Holmes for Complex Video Reasoning?","venue":"cs.CV","work_id":"6d26f54b-33e5-4b18-86b0-7202ab41b867","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2505.21374","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:1740a196525940e54d26c09059963a24cd3819ff24fba010065df68c89d6f80e","observation_id":"d28f9118-c0c5-448e-b494-3e5058a60521","resolution":{"observed_at":"2026-06-30T10:44:36.827322Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.16141","last_updated":"2025-06-19T08:49:13Z","snapshot_observed_at":"2026-08-08T06:18:41.273900Z","submitted_at":"2025-06-19T08:49:13Z","title":"GRPO-CARE: Consistency-Aware Reinforcement Learning for Multimodal Reasoning","version":1},"cited_work":{"arxiv_id":"2506.16141","doi":"10.48550/arxiv.2506.16141","metadata_source":"arxiv_reference","pith_arxiv_id":"2506.16141","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Grpo- care: Consistency-aware reinforcement learning for multimodal reasoning","venue":"ArXiv.org","work_id":"41a7dfb7-5564-4132-89bf-b7301ad2fd75","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2506.16141","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:b10f12c3d84a4030c628f8e1d88eac824d15f0d8f9f3ca8f3a2416865029fcd1","observation_id":"1ef5e2ec-7c53-4b66-8092-847994b7ba01","resolution":{"observed_at":"2026-06-30T10:44:36.816892Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.237036Z","title":"Self-correcting llm-controlled diffusion models,","venue":null,"work_id":"9e821722-3bcd-41a8-8c63-0f272696522b","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:28d64bc4f610cf23191e1594faab9d16eefa455abd88a836fe527d6d3a1b30ec","observation_id":"0e3f530e-357d-408c-a5af-8338b51da26b","resolution":{"observed_at":"2026-07-09T13:16:16.238240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.231785Z","title":"Mastering text-to-image diffusion: Recaptioning, planning, and generating with multimodal llms,","venue":null,"work_id":"2282bc1e-692e-4f7a-bbc6-e565d7eac793","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:bfcdd78729732e7013d7b9f109de436ea90b3aa86af1b5a3d54c889fb8dd43af","observation_id":"42427bc5-8a99-4958-b17b-6688a6999ec3","resolution":{"observed_at":"2026-07-09T13:16:16.233012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.229929Z","title":"Mindomni: Unleashing reasoning generation in vision language models with rgpo,","venue":null,"work_id":"408a1b83-8c3b-443f-984b-759de241c755","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:7f2887763100c343c7e8d1c29243f88620ec38ed9a1319bddb1efc185e107876","observation_id":"5f3f4aee-245d-48dd-8234-7243b769e53f","resolution":{"observed_at":"2026-07-09T13:16:16.231221Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.274861Z","title":"Videodirectorgpt: Consistent multi-scene video generation via llm-guided planning,","venue":null,"work_id":"ce64e38c-26ef-47cb-88d9-464e995562a8","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:de77905ba4cc326fedd1fbc750b345bd7e8c7a391cb220514d5b8ba850bc8ce6","observation_id":"eaabb265-9f36-4c6d-88a4-591cfff12d08","resolution":{"observed_at":"2026-07-09T13:16:16.276116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.238798Z","title":"Vlipp: Towards physically plausible video generation with vision and language informed physical prior,","venue":null,"work_id":"6eb19df6-ee2d-4efe-b855-ce6cdff24086","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:3c57709156ff6ac2a41ea350c0ba1793ba7aa5301fc491a32152b63e95808a8c","observation_id":"e73844c5-41c0-4276-b2d0-3dc720c37b49","resolution":{"observed_at":"2026-07-09T13:16:16.240165Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.233557Z","title":"Videoagent: Long-form video understanding with large language model as agent,","venue":null,"work_id":"58bbb3ab-b762-4f68-bc3c-32cc59dc79ac","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:17077f575d1676b1be7849e61ca632b727a719cdfb2909b661a21da239acd226","observation_id":"afdb13c4-28d4-498f-8501-dd10298baabc","resolution":{"observed_at":"2026-07-09T13:16:16.234804Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.05094","last_updated":"2026-05-21T08:23:12Z","snapshot_observed_at":"2026-08-01T23:38:17.815297Z","submitted_at":"2025-10-06T17:57:59Z","title":"VChain: Chain-of-Visual-Thought for Reasoning in Video Generation","version":2},"cited_work":{"arxiv_id":"2510.05094","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.05094","snapshot_observed_at":"2026-07-04T17:29:59.579376Z","title":"Vchain: Chain-of-visual-thought for rea- soning in video generation.arXiv preprint arXiv:2510.05094","venue":"cs.CV","work_id":"58eca142-6f18-4d2a-b9a6-86499cfe095b","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2510.05094","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:111c13bd7676a5fcf90973accdcfc75abc7ef8ad0d69e0dadf88d2a787b9e4f4","observation_id":"e254e73d-49b7-466b-a8cb-34739b3e5b7a","resolution":{"observed_at":"2026-06-30T10:44:36.804558Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15458","last_updated":"2026-05-14T22:40:56Z","snapshot_observed_at":"2026-08-01T23:49:14.751351Z","submitted_at":"2026-05-14T22:40:56Z","title":"Video Models Can Reason with Verifiable Rewards","version":1},"cited_work":{"arxiv_id":"2605.15458","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.15458","snapshot_observed_at":"2026-07-01T22:26:17.190867Z","title":"Video Models Can Reason with Verifiable Rewards","venue":"cs.CV","work_id":"851557de-469b-4c8a-8739-9ae46fe1151e","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2605.15458","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:532073d53f722a009877ea114f6fb696151cd54fbe7c7d3a39862823193a8cf4","observation_id":"1e8a46db-da97-47f2-9914-08673b937a3f","resolution":{"observed_at":"2026-06-30T10:44:36.806976Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.225891Z","title":"Dual-process image generation,","venue":null,"work_id":"c0393731-b17b-4e65-9a93-941da0128dc5","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:97bf42b6273bae3319657e4cfb4e14b090326fd772abaf1f3c4f3b54664f1e23","observation_id":"e082c361-59df-4769-bf90-26132d396e0a","resolution":{"observed_at":"2026-07-09T13:16:16.227430Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.14978","last_updated":"2026-04-24T18:47:15Z","snapshot_observed_at":"2026-08-04T00:00:30.501007Z","submitted_at":"2025-10-16T17:59:57Z","title":"Learning an Image Editing Model without Image Editing Pairs","version":2},"cited_work":{"arxiv_id":"2510.14978","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.14978","snapshot_observed_at":"2026-07-02T02:36:26.898923Z","title":"Learning an Image Editing Model without Image Editing Pairs","venue":"cs.CV","work_id":"2954aba5-4eea-4d09-acd4-74b246875429","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2510.14978","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:a4bf334f0f10fef2e7d0e3b71666229f55adc0aa0f1e7e07d53a2ba62e4d9030","observation_id":"bb2bc99e-989d-4b3b-a177-a2b1872e68de","resolution":{"observed_at":"2026-06-30T10:44:36.824660Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.04153","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T01:37:30.568830Z","title":"Diffusion-drf: Differentiable reward flow for video diffusion fine-tuning","venue":null,"work_id":"f185bd92-0517-4e2a-bc5f-60fc98d465da","year":2026},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:bc5d8d7361dcaa3998f472b49d7821bbec95ef5b3d240bae007675fba6971467","observation_id":"bf8d4835-ffa5-48fc-ae36-dda67cc92aaa","resolution":{"observed_at":"2026-06-30T10:44:36.866479Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.221353Z","title":"Lightx2v: Light video generation inference framework,","venue":null,"work_id":"daa07427-c7b2-4d67-8155-6411d293a384","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:d0be76d573cb2e82d6f5f53f5df9809ee593eda198b6572eb2a721d2eef20f3a","observation_id":"8f5f9792-af90-411c-aefd-a0e2b0850cb8","resolution":{"observed_at":"2026-07-09T13:16:16.222858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.219362Z","title":"Improved distribution matching distillation for fast image synthesis,","venue":null,"work_id":"fe1241bd-29c8-4d97-b90e-b3aa1d5f6dc5","year":2024},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:a642818ba9bf4dc399ead479dfa07c2f6de87bddb5d0c5ca3aafa6634fc8c44f","observation_id":"dee8e5c6-7b07-487e-b0a7-a4e0c5107593","resolution":{"observed_at":"2026-07-09T13:16:16.220741Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.223472Z","title":"Openai o3 and o4-mini system card,","venue":null,"work_id":"eff2e476-85fd-4b20-bcc9-5c6d7e0440cc","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:8d87ac65b13eee88ba2d1fbc2223b08e2c6a266345cdfec4f9631cb206d6d598","observation_id":"9f548417-de46-4454-af42-6d05cc4f8232","resolution":{"observed_at":"2026-07-09T13:16:16.225265Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.228033Z","title":"Kling AI launches video 2.6 model with “simultaneous audio-visual generation","venue":null,"work_id":"715b2ca7-dc8f-44e3-b20a-1c6b068c225e","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:a2d41ab512137efb06416345c4fbe9575c5b2cf894d03a865ec3aef558076a4d","observation_id":"9c49f700-a81b-4b1a-9613-ddb57c845636","resolution":{"observed_at":"2026-07-09T13:16:16.229350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:3cff10a39732608b2d5c5f39f328ac0ae57351bcf8c2688016696405ecfe0edd","observation_id":"9c5024d0-3aa6-4518-94e2-e7020981ba2d","resolution":{"observed_at":"2026-06-30T10:44:36.856094Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.213197Z","title":"Flow-grpo: Training flow matching models via online rl,","venue":null,"work_id":"03fe2147-4ce2-4383-8991-d2bd1cb46930","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:73359903e60ac34cb9c75e4eced07543c533c1b16c4bf43a7ae9f5507712c2d2","observation_id":"ef39d6ca-aca9-48b0-bd48-b3a8cf1c58da","resolution":{"observed_at":"2026-07-09T13:16:16.214655Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.217307Z","title":"Video-mme: The first-ever comprehensive evaluation benchmark of multi-modal llms in video analysis,","venue":null,"work_id":"ebb82605-a87b-4ee2-af63-85aad3c544e2","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:fa7af2664a1b26aaa8fe97c87674b87791c6f7e8a2dd7b14692613f8bf6c6945","observation_id":"d65837a3-37b2-4f7d-9a49-abca4427436b","resolution":{"observed_at":"2026-07-09T13:16:16.218780Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.10479","last_updated":"2025-04-19T03:47:21Z","snapshot_observed_at":"2026-08-10T18:37:57.419939Z","submitted_at":"2025-04-14T17:59:25Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","version":3},"cited_work":{"arxiv_id":"2504.10479","doi":"10.48550/arxiv.2504.10479","metadata_source":"pith","pith_arxiv_id":"2504.10479","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"InternVL3: Exploring Advanced Training and Test-Time Recipes for Open-Source Multimodal Models","venue":"cs.CV","work_id":"fe8637aa-12bc-4434-8d36-9f57b5eebcbe","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2504.10479","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:cd875d10951587a20168495c89373a518710870e25a47ea19a13e5d98367c290","observation_id":"2bdb73d8-9f60-4d07-982c-d66250bedf61","resolution":{"observed_at":"2026-06-30T10:44:36.853761Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-20T07:54:09.017512+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.18870","last_updated":"2025-11-25T02:52:10Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-11-24T08:22:07Z","title":"HunyuanVideo 1.5 Technical Report","version":2},"cited_work":{"arxiv_id":"2511.18870","doi":null,"metadata_source":"pith","pith_arxiv_id":"2511.18870","snapshot_observed_at":"2026-07-10T01:46:40.932396Z","title":"HunyuanVideo 1.5 Technical Report","venue":"cs.CV","work_id":"ed898a38-b053-407c-bbce-41561510c1de","year":2025},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"cited_paper":"/paper/2511.18870","citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:f8dc701a0273ca08193eb499f542fc0e5858ebf59652302ba694775abc8ffe07","observation_id":"f089b9a7-c3f6-4acc-9969-812f1bfda836","resolution":{"observed_at":"2026-06-30T10:44:36.863984Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T13:16:16.235324Z","title":"Fvd: A new metric for video generation,","venue":null,"work_id":"a3e9653e-dbf8-44f5-a79a-2909523aa2a0","year":2019},"citing_paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization","version":3},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-06-30T10:38:22.619277Z"},"links":{"citing_paper":"/paper/2606.02564"},"observation_digest":"sha256:084fa214d5d2a08bb790b52c77ac6bc4fb4d94cb20016334013bcecb38be5043","observation_id":"277b75f9-589a-4dfa-a3c6-2424af01dd3a","resolution":{"observed_at":"2026-07-09T13:16:16.236439Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-11T06:34:44.6726+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2606.02564","last_updated":"2026-06-27T07:03:15Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:42:58.036516Z","submitted_at":"2026-06-01T17:54:26Z","title":"VLMs are Good Teachers for Video Reasoning via Adaptive Test-Time Optimization"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":1,"verified_exact":42,"verified_fuzzy":35},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 1 inbound Pith citation observation for arXiv:2606.02564."}