{"as_of":"2026-08-08T20:20:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:a2cdfe57599ab3f6f558befcfe36086f3cc2b484407f929b1ffd05b9f5e565fa","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:46:11.970443Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.25266/citation-record","integrity":"/paper/2607.25266/integrity","json":"/paper/2607.25266/citation-record.json","paper":"/paper/2607.25266"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:06.616896Z","title":"In: Proceedings of the 2024 Conference on Empirical Methods in Natural Language Processing, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.616896Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:104db38f01f7ae889e9250b31ef7d2fd10014e45753dc4a0667a9290ddf41111","observation_id":"bc04faf9-fb7c-42f0-b72e-f69bf3470cbd","resolution":{"observed_at":"2026-08-03T01:46:06.616896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:06.637726Z","title":"In: Proceedings of the 62nd Annual Meeting of the Association for Computa- tional Linguistics (Volume 1: Long Papers), pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.637726Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:b9aa98f37b00905257d45b4d09f5bfa65f3cdcc349be4b870948722669274ba4","observation_id":"8f36ac6a-9e37-485b-86ec-ce666ee1a47c","resolution":{"observed_at":"2026-08-03T01:46:06.637726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-03T01:46:06.703563Z","title":"5-vl technical report","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.703563Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:e40e0854e2fb2d22c924e4036b968f6465e9c147d8b2e2b7044d0bc39baedad9","observation_id":"63cabc03-d644-4968-a342-b5256635f0de","resolution":{"observed_at":"2026-08-03T01:46:06.703563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:06.722449Z","title":"Science China Infor- mation Sciences67(12), 220101 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.722449Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:ad0aa502e01d2e8ca94182ffafdd84549a4ebac9709f55aa89b2d0ba2904c5c2","observation_id":"dfd1197c-6eb0-41e2-9ee8-7d021fc5f2d8","resolution":{"observed_at":"2026-08-03T01:46:06.722449Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:06.771786Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference, pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.771786Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:4944bf1afc775bd829135edb03d1d7935191d168a918b58197c07b4b42d05361","observation_id":"b072b137-65f7-4337-9642-a4784281d148","resolution":{"observed_at":"2026-08-03T01:46:06.771786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:06.789121Z","title":"Advances in Neural Informa- tion Processing Systems37, 28828–28857 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.789121Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:644547a1871c3769762a3c7f65f7ab7a447f4c4af1994373da0b6df0559b0ec5","observation_id":"00dec503-d131-458d-81bc-04e9e6785b3b","resolution":{"observed_at":"2026-08-03T01:46:06.789121Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:06.838971Z","title":"In: Proceedings of the IEEE/CVF Win- ter Conference on Applications of Computer Vision, pp","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.838971Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:4647e95455fdbc42af004212e4840e40def87567e99b854a52012dc493eff668","observation_id":"6eb97a2c-4bfd-4e27-ba22-c3cf64ac2332","resolution":{"observed_at":"2026-08-03T01:46:06.838971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:06.861802Z","title":"In: Proceedings of the Computer Vision and Pattern Recogni- tion Conference, pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.861802Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:1e37c1418daf288f6f6de22ec3b373dea1229f569dab8e5bd7e8b2c33c8dfb41","observation_id":"5845b1f7-9b05-42f8-acd3-dd48b667bc90","resolution":{"observed_at":"2026-08-03T01:46:06.861802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.01071","last_updated":"2025-08-02T13:32:09Z","snapshot_observed_at":"2026-07-06T19:09:10.244642Z","submitted_at":"2024-09-02T08:52:58Z","title":"VideoLLaMB: Long Streaming Video Understanding with Recurrent Memory Bridges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.01071","snapshot_observed_at":"2026-08-03T01:46:06.891797Z","title":"arXiv preprint arXiv:2409.01071 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.891797Z"},"links":{"cited_paper":"/paper/2409.01071","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:859ceed739a05288b90719c4028db9284758f0ab74f0769f252730879fdb8690","observation_id":"94ae74b1-982f-4230-ac96-898394411722","resolution":{"observed_at":"2026-08-03T01:46:06.891797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:06.924351Z","title":"In: Proceedings of the IEEE/CVF Inter- national Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.924351Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:5b7c7e3de3d9233d2239184965a4c5a9acf44469f51ba7187e32218a3b304d40","observation_id":"fe796513-85e9-46ae-9507-49e484463c3d","resolution":{"observed_at":"2026-08-03T01:46:06.924351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:06.983013Z","title":"Transactions of the Asso- ciation for Computational Linguistics12, 157–173 (2024) 14","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:06.983013Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:8fb09ff646cc4f24164f21fa9a08f669123b0f0f866bbc2d3de89b91d1968ae0","observation_id":"f4e65910-07c3-4025-be7a-382dadcc3bbb","resolution":{"observed_at":"2026-08-03T01:46:06.983013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:07.049054Z","title":"In: Christodoulopoulos, C., Chakraborty, T., Rose, C., Peng, V","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.049054Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:9957e86ce3c797d046be0c8207da71bc38e2d60b6883c5097daf85a404f7dcd8","observation_id":"853e66be-becf-4cc4-a7e4-5f69f6f21734","resolution":{"observed_at":"2026-08-03T01:46:07.049054Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:07.130249Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.130249Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:deab43c44439603fd112a1e8a076b6437c1848c62dc7967125cc0c12f5a9b0fb","observation_id":"7fd36ae9-52e7-41f7-8523-194df55d8b51","resolution":{"observed_at":"2026-08-03T01:46:07.130249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:07.218418Z","title":"In: The Thirty- ninth Annual Conference on Neural Information Processing Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.218418Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:9fde3a57b0941accbdf7785071749e4e28642aeda17471ddee1d5d627e5ccb34","observation_id":"fe40c458-93ec-4e4e-8d1c-07d91a5457c9","resolution":{"observed_at":"2026-08-03T01:46:07.218418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:07.297764Z","title":"In: Che, W., Nabende, J., Shutova, E., Pilehvar, M.T","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.297764Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:d899fd9703443f2613e280819b6f6030520f5b0c0b3ec414aec5b4860cf758eb","observation_id":"ec25acb7-0d3c-41c0-9dfb-a00dd7bbd92a","resolution":{"observed_at":"2026-08-03T01:46:07.297764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:07.355530Z","title":"In: European Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.355530Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:3782f1ae1c42f40060eac191a2dff88b0a9e0eafdb0f77f28e5f930cd51ebfb8","observation_id":"9f54a52c-95a3-444c-8981-429fd142b98c","resolution":{"observed_at":"2026-08-03T01:46:07.355530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:07.435780Z","title":"In: The Thirty-ninth Annual Conference on Neu- ral Information Processing Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.435780Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:c4f36fc01c983401a522fcbd8466e62b8e063cc8685bbb402ebf960349f08347","observation_id":"1b3fb90d-aa69-48c6-827b-6a3da779f8d8","resolution":{"observed_at":"2026-08-03T01:46:07.435780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:07.491136Z","title":"arXiv preprint arXiv:2510.04428 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.491136Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:e979cc888b90b7deed9332e86db56b1a95d0b54c52f77529ad8bdec230c92d3e","observation_id":"02f73198-e42e-47d4-8044-fe942c0bac57","resolution":{"observed_at":"2026-08-03T01:46:07.491136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.05774","last_updated":"2026-06-04T07:27:00Z","snapshot_observed_at":"2026-08-03T18:22:22.611333Z","submitted_at":"2025-12-05T15:03:48Z","title":"Active Video Perception: Iterative Evidence Seeking for Agentic Long Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.05774","snapshot_observed_at":"2026-08-03T01:46:07.582823Z","title":"https://arxiv","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.582823Z"},"links":{"cited_paper":"/paper/2512.05774","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:28a5f47e63d639f36371fc040c6805a5a4bf53dce74efd52764b84c504a03389","observation_id":"0dbe0cc8-4ad6-44f9-a539-8402412a25ad","resolution":{"observed_at":"2026-08-03T01:46:07.582823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:07.669126Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference, pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.669126Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:ef4f8ac8239ece1f4436f1673b5de549d5a90c2746f876e567a077828f011be9","observation_id":"4dc4775c-06e0-4fe8-9a1c-b5a1e5bd8e63","resolution":{"observed_at":"2026-08-03T01:46:07.669126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:07.794335Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.794335Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:76730ad7c9e0f95eed20ff79e9d35172cea031e911fd65d736524acb4bba7fbe","observation_id":"40b065e1-4618-4a25-b8f7-c20155686819","resolution":{"observed_at":"2026-08-03T01:46:07.794335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:07.907269Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference, pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:07.907269Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:975ad1d056dc33c9a7f5fcc6e3efc6256e7394ad006bede5923f876a5144bec6","observation_id":"a2abd73f-af56-47d4-b895-e433d57d4a4c","resolution":{"observed_at":"2026-08-03T01:46:07.907269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.004400Z","title":"arXiv preprint arXiv:2502.03183 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.004400Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:717ddf0aceb99953bfa22780b6823252bc35066dace4ce467e48c65354e79e1d","observation_id":"027efb18-2848-443d-964b-601be6dcef90","resolution":{"observed_at":"2026-08-03T01:46:08.004400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.096580Z","title":"15 In: Proceedings of the IEEE/CVF Inter- national Conference on Computer Vision (ICCV), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.096580Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:246f5d971e02f9986a924898df0488fab8105bb708745883a94c73633f93f223","observation_id":"eb3f99c0-9757-4e5a-99c3-6eb2f97e86ea","resolution":{"observed_at":"2026-08-03T01:46:08.096580Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.182399Z","title":"European Conference on Computer Vision (ECCV) (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.182399Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:c828b395d1c9b8a666cf61a1d5b664f46748898875c562bf6324d718d1429ede","observation_id":"06ea1378-e013-45f9-b521-823fce82c210","resolution":{"observed_at":"2026-08-03T01:46:08.182399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.245013Z","title":"Advances in Neural Information Processing Systems36, 76749–76771 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.245013Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:f43da261bb724b5ddbcef028a6df2dacb8058488f07d4d7ede053e83b927d6c5","observation_id":"f73a3324-1ef9-481a-9461-5877d1fa84bc","resolution":{"observed_at":"2026-08-03T01:46:08.245013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-03T01:46:08.298086Z","title":"arXiv preprint arXiv:2511.21631 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.298086Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:550765f630eb63679b9176f1e841e8689cf3ac7b0b0089a5fa6595ba785e8408","observation_id":"e3feace9-1dcc-4709-9d48-978029a4cc7b","resolution":{"observed_at":"2026-08-03T01:46:08.298086Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.380485Z","title":"In: Proceedings of the IEEE/CVF International Conference on Computer Vision (ICCV), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.380485Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:5278b0f9d4221856cf0ec9cd9619d345e7e1cbfc1d683fcbd6f6f02593b90736","observation_id":"d2e32f27-452f-4e7f-888a-b85699a605ee","resolution":{"observed_at":"2026-08-03T01:46:08.380485Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.472332Z","title":"In: Che, W., Nabende, J., Shutova, E., Pilehvar, M.T","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.472332Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:46b01b1f1b3130338654faa77330705bdfa407493131f19826e298521d2bf683","observation_id":"36a0968e-e83f-4e4b-ad46-a92ae4a07355","resolution":{"observed_at":"2026-08-03T01:46:08.472332Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.531020Z","title":"In: Forty-second International Conference on Machine Learning (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.531020Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:bc56847dbac417d333101ee5df9475916e5e6590ff2776260120b1e483b7d646","observation_id":"5b7040e5-2767-4009-900c-fd8951b68c0c","resolution":{"observed_at":"2026-08-03T01:46:08.531020Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.613142Z","title":"In: The Thirty-ninth Annual Conference on Neu- ral Information Processing Systems (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.613142Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:30f3f32c83512419c5af2f0cf71faa243014ddc72e0aa9546f586249aa6c261d","observation_id":"496ec91f-c6a1-4ab4-98b4-cf0f2414ba61","resolution":{"observed_at":"2026-08-03T01:46:08.613142Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.700828Z","title":"Advances in neural information process- ing systems34, 13937–13949 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.700828Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:d556f4f3effdfad00c343333ab968db5c7a2a1c3ad32277e482714bd933d706b","observation_id":"dbe0aaae-e529-411c-bff6-7ead93b9ef21","resolution":{"observed_at":"2026-08-03T01:46:08.700828Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.762518Z","title":"In: European Conference on Computer Vision, pp","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.762518Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:f31b7b6e78f6c11734b8209d43a431591796e0ecb4751c63d8865d92a2d28ee1","observation_id":"e75d26d8-805f-4a2d-8e72-613ce88b4f68","resolution":{"observed_at":"2026-08-03T01:46:08.762518Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.846049Z","title":"In: European Conference on Com- puter Vision, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.846049Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:9737e0a5e7c9ddec174ec23a5ae658a9f290aa5500afb38821998e6f50b60df4","observation_id":"4e2aaf1f-104a-4d8f-8809-5ea5d83a4375","resolution":{"observed_at":"2026-08-03T01:46:08.846049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03226","last_updated":"2025-03-28T03:19:52Z","snapshot_observed_at":"2026-07-06T19:27:33.934338Z","submitted_at":"2024-10-04T08:26:06Z","title":"Frame-Voyager: Learning to Query Frames for Video Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03226","snapshot_observed_at":"2026-08-03T01:46:08.921261Z","title":"arXiv preprint arXiv:2410.03226 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.921261Z"},"links":{"cited_paper":"/paper/2410.03226","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:2a8126b4c8a0b0c92c48dc343f66ed16f61fc37e0e207aa8774fe7ee3494ac5f","observation_id":"7f1b878f-50f5-4223-a2f1-686a3e954218","resolution":{"observed_at":"2026-08-03T01:46:08.921261Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:08.993294Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference, pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:08.993294Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:37b7af93f357ceff268d357d2071341e6f475be409241107a137bda2ed6156d6","observation_id":"2c69a7a8-0b57-4d21-980d-066e82e0cb5c","resolution":{"observed_at":"2026-08-03T01:46:08.993294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.066055Z","title":"In: Proceedings of the Computer Vision and Pat- tern Recognition Conference, pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.066055Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:4d339ab246cf1b17d53693050661fa14c2cd046526b3cf2d9de08ad553337f28","observation_id":"94354a3c-a955-4cc5-b43a-3c2d13681273","resolution":{"observed_at":"2026-08-03T01:46:09.066055Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1811.12432","last_updated":"2019-04-10T14:54:13Z","snapshot_observed_at":"2026-08-05T02:32:45.416647Z","submitted_at":"2018-11-29T19:08:52Z","title":"AdaFrame: Adaptive Frame Selection for Fast Video Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1811.12432","snapshot_observed_at":"2026-08-03T01:46:09.137255Z","title":"https://arxiv.org/abs/1811.12432","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.137255Z"},"links":{"cited_paper":"/paper/1811.12432","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:aaedbb38fbc6018adc203d99061b1e3f70ad5f1f8be75ea1d10cf01bc215cf38","observation_id":"3a3ad66f-2321-4b0b-aeef-3df0cd1fc2ff","resolution":{"observed_at":"2026-08-03T01:46:09.137255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1907.13369","last_updated":"2019-08-02T11:13:13Z","snapshot_observed_at":"2026-08-07T20:35:49.481867Z","submitted_at":"2019-07-31T08:51:31Z","title":"Multi-Agent Reinforcement Learning Based Frame Sampling for Effective Untrimmed Video Recognition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1907.13369","snapshot_observed_at":"2026-08-03T01:46:09.193469Z","title":"https://arxiv.org/ abs/1907.13369","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.193469Z"},"links":{"cited_paper":"/paper/1907.13369","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:4c8db019c5a2f868346c77968247ce978dc2961d6c5d5917508eadb41ddce622","observation_id":"528cfabf-5346-46df-abc1-6e221876a984","resolution":{"observed_at":"2026-08-03T01:46:09.193469Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.255377Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.255377Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:eeb9442854f49983dc9560936fdb2a544cfb9cb34439ee082983168e11f21f02","observation_id":"743d3406-674a-44e0-b9ce-4fb620c7a9e1","resolution":{"observed_at":"2026-08-03T01:46:09.255377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.308438Z","title":"In: Proceedings of the Computer Vision and Pattern Recognition Conference, pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.308438Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:f096d10635c2f66d99f3f2ddfedc242805f99f93858e7876b1575c1583531e65","observation_id":"dfedbbe5-f862-4b45-a8ef-eb66866c41da","resolution":{"observed_at":"2026-08-03T01:46:09.308438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.365664Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pat- tern Recognition (CVPR), pp","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.365664Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:57d8bcd0ddb13e47507c7489aee0f8230e102c4043ed82d1326809547d9cc3b3","observation_id":"8385c12b-768c-41ee-8cb4-456e2c7b0dc5","resolution":{"observed_at":"2026-08-03T01:46:09.365664Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.448919Z","title":"In: Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.448919Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:7728cbe48ea4d845a8912f9cb4cb65175bd50c8c69429b0f738004deec06d353","observation_id":"3e2d336e-368f-4069-8a42-27d25ed80662","resolution":{"observed_at":"2026-08-03T01:46:09.448919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.508348Z","title":"IEEE Transactions on Image Processing32, 3013–3026 (2023) https://doi","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.508348Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:e010403bf7ce8ec55648cfdca1cb87a839214dc8193bb02a3da88fbcf2f5763f","observation_id":"8b68886c-c602-4ea0-a9f9-0f527f55fc10","resolution":{"observed_at":"2026-08-03T01:46:09.508348Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.572576Z","title":"In: Fleet, D., Pajdla, T., Schiele, B., Tuytelaars, T","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.572576Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:308cc5c053d8f94e2294674cbed30529170bbd28ca31034806691a296b035fda","observation_id":"e96cffc2-977d-40d0-ae04-6c55180e0cd3","resolution":{"observed_at":"2026-08-03T01:46:09.572576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.637477Z","title":"In: Proceedings of the IEEE Conference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.637477Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:d1ae576731a63537ffcf4d4dd77a96e0dfc92cc1a8734a5ebe5c40bd19c2b852","observation_id":"9bba8da5-e4af-4cf0-8b21-30bee8198a93","resolution":{"observed_at":"2026-08-03T01:46:09.637477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.703143Z","title":"Advances in neural information processing systems27 (2014)","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.703143Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:6be7f78561f6453c60ad2aecb806f284cf1951e95ef83188087837381e7816b8","observation_id":"3979ab5d-b42c-47cf-8137-37917910f0b3","resolution":{"observed_at":"2026-08-03T01:46:09.703143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.792666Z","title":"In: Proceedings of the IEEE Con- ference on Computer Vision and Pattern Recognition, pp","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.792666Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:d1d3a3adab39db6eeab10887803f16f295964b70eba03886d9ec068207546d53","observation_id":"b3fb7a3f-a3b2-40bf-9342-60fe5921446c","resolution":{"observed_at":"2026-08-03T01:46:09.792666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.852328Z","title":"In: Proceedings of the 2020 International Con- ference on Multimedia Retrieval, pp","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.852328Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:05554db5381bf200adfa9baaeb904c17980d4a81386ec156bb9e396b4a3e9855","observation_id":"8a805f24-5e68-4bc7-838f-ed4aa3b2b9ed","resolution":{"observed_at":"2026-08-03T01:46:09.852328Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.918961Z","title":"In: 2023 IEEE International Conference on Image Process- ing (ICIP), pp","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.918961Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:918540e980f80518275c5a160614f910930f6561771e430ea8f3a0b9b8491d10","observation_id":"3ee479e8-e5f6-437f-9ed4-8c327cd2ebca","resolution":{"observed_at":"2026-08-03T01:46:09.918961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:09.998094Z","title":"arXiv preprint arXiv:2602.08861 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:09.998094Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:79f956bcb5ebf3c93ff4f556ab3670c32ad63fcb3c781b8832d25ff9b2547a3e","observation_id":"14484165-4de6-47f9-bc21-42cf4527272d","resolution":{"observed_at":"2026-08-03T01:46:09.998094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:10.086676Z","title":"https://arxiv.org/abs/2512.04000","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:10.086676Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:6dcd45d57feab53b05d2c30e467ed78980c531e91c860f30f6a09ac09218a61d","observation_id":"05cb5e37-a0c1-4898-b7f7-04dff09c4623","resolution":{"observed_at":"2026-08-03T01:46:10.086676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:10.235430Z","title":"arXiv preprint arXiv:2601.11359 (2026) 17","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:10.235430Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:946453c611a64479f91a4b20b36a457f49c45232eb08d4c356b8906efc471fb5","observation_id":"6c434d88-a45d-4db0-b9ee-760e25862cd5","resolution":{"observed_at":"2026-08-03T01:46:10.235430Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:10.339736Z","title":"arXiv preprint arXiv:2602.03615 (2026)","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:10.339736Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:7083f157e666ff63a78f703de1419f7381f58d30c59106bbb7eb1bd876d1e421","observation_id":"9810fac3-8d03-4757-87eb-feffb71375ea","resolution":{"observed_at":"2026-08-03T01:46:10.339736Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:10.447894Z","title":"https://openreview.net/forum? id=L0dORRnUhu","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:10.447894Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:3532055239c4add7048f12edafd9362b8d35547a01987e54dc97e4931d193991","observation_id":"58e88d1a-4334-4a48-9955-2bb84d02d6a2","resolution":{"observed_at":"2026-08-03T01:46:10.447894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:10.540527Z","title":"Foun- dations and Trends®in Machine Learning 5(2–3), 123–286 (2012)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:10.540527Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:97f2f79bef81a436ce715eb3cd16b5291b89bddc5f7c02b5b43b257c2b85a722","observation_id":"0b55d650-7883-4479-90a5-6f47a10e4801","resolution":{"observed_at":"2026-08-03T01:46:10.540527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:10.603619Z","title":"In: Matrix Methods: Theory, Algorithms and Applications, pp","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:10.603619Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:03a8272d5c223fd7fb6877b07ca41d5432f082339f598b12c3c7e911552755b1","observation_id":"4a1e09a4-afd7-4e17-ae13-31ef22198fdd","resolution":{"observed_at":"2026-08-03T01:46:10.603619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:10.770911Z","title":"Linear Algebra and its Applica- tions538, 187–211 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:10.770911Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:037b0bae008f04120b02d03cb5c7db483ee493a369cf9bd0ff161abdeb3eaaba","observation_id":"08d25d29-6cba-440d-8ac7-1da1ac675749","resolution":{"observed_at":"2026-08-03T01:46:10.770911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:10.971092Z","title":"Mathemat- ical programming14(1), 265–294 (1978)","venue":null,"work_id":null,"year":1978},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:10.971092Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:1c6c17f4625bb8ebbb37f099748183ba415a8ba55627f4a7a6449efac2f43a94","observation_id":"6dfe0019-f2aa-421b-b79a-c0989a626f22","resolution":{"observed_at":"2026-08-03T01:46:10.971092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:11.094519Z","title":"Wiley-Interscience, ??? (2006)","venue":null,"work_id":null,"year":2006},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:11.094519Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:4e9cd357f359fef70cfe0a66964f4c71301fd94e4fb6829c95940775f13ee2e1","observation_id":"6e4a48f3-aa8b-4d1f-98ab-cd416b8c6536","resolution":{"observed_at":"2026-08-03T01:46:11.094519Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:46:11.200923Z","title":"International Journal of Computer Vision30(2), 79–116 (1998)","venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:11.200923Z"},"links":{"citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:2e288d79915b1af82339363a9eaae96f50a3cdaf829baa2cfe906705df1be531","observation_id":"66207a23-3dc0-47fa-ad7b-7255a7bfdbd4","resolution":{"observed_at":"2026-08-03T01:46:11.200923Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19786","last_updated":"2025-03-25T15:52:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-25T15:52:34Z","title":"Gemma 3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19786","snapshot_observed_at":"2026-08-03T01:46:11.350293Z","title":"arXiv preprint arXiv:2503.19786 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:11.350293Z"},"links":{"cited_paper":"/paper/2503.19786","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:431856c60d082aca712363135fed1c653c50835c76a5f70921d13273defc49a6","observation_id":"c9609d78-fde4-4b42-bb8a-7c39a18c9b3b","resolution":{"observed_at":"2026-08-03T01:46:11.350293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-03T01:46:11.460733Z","title":"arXiv preprint arXiv:2408.03326 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:11.460733Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:d2868522dcaf5d8cbc1e743931673fa39b16fde9b4ffecc7582eb201a3bcc3ba","observation_id":"c2664e34-4646-4841-a1fd-2ad6c4234aba","resolution":{"observed_at":"2026-08-03T01:46:11.460733Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-08-07T09:52:45.942315Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16852","snapshot_observed_at":"2026-08-03T01:46:11.620891Z","title":"arXiv preprint arXiv:2406.16852 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:11.620891Z"},"links":{"cited_paper":"/paper/2406.16852","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:7daecbe30b835022fc5bcf79d6b155978a01bbe8e7e57c907bf558ad3d4cbb33","observation_id":"0f75a7bd-e6b7-48e4-b7f0-cb520a05acf6","resolution":{"observed_at":"2026-08-03T01:46:11.620891Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12386","last_updated":"2025-07-13T18:57:17Z","snapshot_observed_at":"2026-08-06T07:17:05.291678Z","submitted_at":"2025-01-21T18:59:00Z","title":"InternVideo2.5: Empowering Video MLLMs with Long and Rich Context Modeling","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12386","snapshot_observed_at":"2026-08-03T01:46:11.788344Z","title":"arXiv preprint arXiv:2501.12386 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:11.788344Z"},"links":{"cited_paper":"/paper/2501.12386","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:ad1b41ed82564ede9a5f40bb1c8edc0f3282466c608ca4cb3d4d4d489af9af9b","observation_id":"f0c17133-5f7a-4704-b073-b60832060a27","resolution":{"observed_at":"2026-08-03T01:46:11.788344Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.05271","last_updated":"2025-09-26T12:52:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-06T18:57:08Z","title":"Expanding Performance Boundaries of Open-Source Multimodal Models with Model, Data, and Test-Time Scaling","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.05271","snapshot_observed_at":"2026-08-03T01:46:11.970443Z","title":"arXiv preprint arXiv:2412.05271 (2024) 18","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-03T01:46:11.970443Z"},"links":{"cited_paper":"/paper/2412.05271","citing_paper":"/paper/2607.25266"},"observation_digest":"sha256:bb125e038ba51862722ff5a1a31cbcd4720e4583d4e0c5d5d608b427949c3271","observation_id":"0daba625-b851-4b03-9cb4-c1d56a5b8b5d","resolution":{"observed_at":"2026-08-03T01:46:11.970443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.25266","last_updated":"2026-07-30T21:59:18Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-05T23:11:09.274885Z","submitted_at":"2026-07-28T04:09:49Z","title":"FORGE: Frame Orthogonality in Relevance Geometry for Long-Form Video Understanding"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":66,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2607.25266."}