{"as_of":"2026-08-10T05:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8228da35aab274d9a35513d3d83a23e9cf10baee89f2d02fae70da7cbc761216","coverage":[{"denominator":27,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":27,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T07:13:05.791836Z","state":"measured"},{"denominator":27,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":27,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.04351/citation-record","integrity":"/paper/2606.04351/integrity","json":"/paper/2606.04351/citation-record.json","paper":"/paper/2606.04351"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"and Shen, Yelong and Wallis, Phillip and Allen-Zhu, Zeyuan and Li, Yuanzhi and Wang, Shean and Wang, Lu and Chen, Weizhu , booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:afb0d9a432c4561338fd1acd51be131f8f851b6f866018e191b1d82f12ea6df3","observation_id":"1c680790-b3c1-4003-ba92-4f38e109b4bc","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:4e633698d0c00fbe75e7f4a613057e6de02968c9c292846f68919fc5a1bd04ff","observation_id":"e412d436-4665-4e2c-82b0-c1f5f12bfd6a","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"Proceedings of the 38th International Conference on Machine Learning , pages =","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:f406147da33018159264b578db484f85464f1069aacba660e601920e16cf18ad","observation_id":"1cd8f5aa-cd94-4319-98a0-d7a79e1f5234","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"and Le, Quoc V","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:cad2bcd201f99f759b376b7c9762dbdeb64844e07ff5334d579bee98df22d7f6","observation_id":"2e229a89-a1f0-4704-8c15-c4c69596512e","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.05299","last_updated":"2025-04-07T17:58:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-04-07T17:58:57Z","title":"SmolVLM: Redefining small and efficient multimodal models","version":1},"cited_work":{"arxiv_id":"2504.05299","doi":"10.18653/v1/2025.acl-long.718","metadata_source":"pith","pith_arxiv_id":"2504.05299","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"SmolVLM: Redefining small and efficient multimodal models","venue":"cs.AI","work_id":"810cc87f-f6bd-4443-9673-5e30982426b9","year":2025},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"cited_paper":"/paper/2504.05299","citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:184496b1d75914015e193721773ede8005bb681a2bb78072591d08bbd1ff909e","observation_id":"c817f155-7a6c-47e6-8e3e-c8523ac907cc","resolution":{"observed_at":"2026-07-02T07:06:43.913541Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"IEEE International Conference on Computer Vision , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:32da4256a2201c8cace436beb514f5b4672a4d3476a90ab0d355b0e8d51065e9","observation_id":"71047e75-1aad-4989-8f9f-d9357ab98160","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":", booktitle =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:d076b52c5e1e0811f698dde9eff024c99fa64dd1d266f1dd1926c631bf422cb0","observation_id":"b043cf6d-9185-45f6-aaf1-9dd89ae76e76","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:fa7bb40a5d47567b58815c70e3e03c7d3c12cd866a185042c9611d19072bb607","observation_id":"f03d5776-da77-45e8-a1df-35c42e73d600","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:7c9e5d60b99f87f952e15df0e3e4016008e8a69cd7e8b197956748e888051c60","observation_id":"b1ddd8c7-4556-4a0f-acf4-45917033f658","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"2024 , howpublished=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:ca7bf38c76948ea975f044fcc59cbabce677d5bf615c5bca714e0ad5c59bc22c","observation_id":"f271ccca-96cd-4e7d-b674-dfdb30674f61","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:f9e90e8a79dec5635c0ad2d2b8b3aa8a08b856a9770025571c24033e4bf90f21","observation_id":"d7490b05-099c-4b5f-af6e-d171bbd5d439","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:7d9823f912bf85eba80e1f45394ac6d005dd1fb7a6d5692906d85de8363b0d3b","observation_id":"075de12b-1cc8-4e1c-8116-c406b279ede6","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"Transactions on Machine Learning Research , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:4c08aa7e52f7210b883ecc8c613e4a4afe8fa3fb73242a44d39d1b787c9824ad","observation_id":"ab097b8e-7ded-4e4d-9653-cdc7d698a7cc","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:ec9dfce4aa237116b9ff03b5c71eb84c974e630edb07aea65340ab9907c753c1","observation_id":"a9d5a4f4-9fd0-4ac5-8c86-033cafc8bd49","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:a816a157d74fa67481eff5a1d5cc2c4b13ea1fc56adac4ecddf75b17c2c3af2f","observation_id":"270b05f3-f954-4b90-a286-2a641b828a65","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"International Conference on Learning Representations , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:19d3400af7f6eced1a76c16d1721a77e5f92cdf1aaf60d48f307eebf2b93238f","observation_id":"607cce69-d6aa-4405-a13f-d982cdd84378","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"Annual Meeting of the Association for Computational Linguistics , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:262819a681291d3b6787e6fc3666e7916c7d7811b9f33ef59aebad341386028c","observation_id":"d0c542d9-0b3f-4db6-9059-fa8c97a11166","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"Advances in Neural Information Processing Systems , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:f9fdd249878c20d92149920e71c7f9b8da6d3db89fbad10f9836cd19f8f4fa9f","observation_id":"89fae60d-67d9-48c9-9da9-29597e16d85f","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"Conference on Empirical Methods in Natural Language Processing , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:15ebb8f6d9bd254fe1f68d9c61960ed04d5d64f8324fceefabd471ce84796769","observation_id":"e7e29b0e-b859-4bc2-b66b-0e8a398fa5ae","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.08727","last_updated":"2025-08-08T14:39:42Z","snapshot_observed_at":"2026-08-10T01:42:21.905021Z","submitted_at":"2025-03-11T01:07:57Z","title":"Training Plug-n-Play Knowledge Modules with Deep Context Distillation","version":4},"cited_work":{"arxiv_id":"2503.08727","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2503.08727","snapshot_observed_at":"2026-07-02T07:06:43.909755Z","title":"arXiv preprint arXiv:2503.08727 , year=","venue":null,"work_id":"560579f6-3e8b-491e-8f0d-89aedc2366f9","year":2025},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"cited_paper":"/paper/2503.08727","citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:0a988e054a1b938ab841a759a562fb3a7ef40212e0d5fb150161a7826e98c6de","observation_id":"525b26fc-588e-4f03-9495-6b899802d530","resolution":{"observed_at":"2026-07-02T07:06:43.911176Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:8f40ce7799baac26e180cfe73483f0282e3cbe3d83caa1c40848c21287cc08ea","observation_id":"2d2a6192-357b-4e22-85b2-559eb2d8de85","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:26b899152b61c49a35805d21ad3c6a8b0f9dc07c35c1c05dc1146247500a00e3","observation_id":"3e3c4aa7-2fc9-43d0-919a-d4a68ad6e7f8","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:21118bae5fe284b5bbaf6cc7f41917e5dbec8df8dd3b43ffb13368ab31bd3505","observation_id":"3fac80cf-75a6-4de2-8a48-3a952905a9aa","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"arXiv preprint , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:977b6dc56df8795c5510a69afeaf6732a3cf8403b55fe3ef69f15c90ae570f5a","observation_id":"c1036f3e-7ad4-43a4-b0a8-ac32a6352280","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:4d6f6229197783a8dcd1a1b99cc52888a03a2712768b7c5e052395d1c80a719d","observation_id":"3bd004d2-ceed-45a3-8396-ed35a5d83084","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:1e176f891727a6afaac4fb5d3db2409457791e29e5defefdc91a6fd4d2a9a9aa","observation_id":"9033f5f1-98d8-4689-8b86-eb74207332a8","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T07:13:05.791836Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-28T07:13:05.791836Z"},"links":{"citing_paper":"/paper/2606.04351"},"observation_digest":"sha256:f41b2c983dc4151539a31f0c8feac840437ff6ad24e9e4f44af0064af69209fc","observation_id":"6279f376-e204-43ae-a1fc-ed46a30c636f","resolution":{"observed_at":"2026-06-28T07:13:05.791836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.04351","last_updated":"2026-06-10T09:50:06Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-09T18:22:27.938557Z","submitted_at":"2026-06-03T02:07:35Z","title":"Frames2LoRA: Parametric Video Internalization for Vision-Language Models"},"reference_resolution":{"displayed":27,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":25,"verified_exact":1,"verified_fuzzy":0},"total_outbound_references":27},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 27 of 27 outbound references and 0 inbound Pith citation observations for arXiv:2606.04351."}