{"as_of":"2026-08-18T14:36:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:709c574891e036848e50a1be5f17c227ae9c90321e2cd2bb9b0c7ba80781af25","coverage":[{"denominator":75,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":75,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T15:08:38.986063Z","state":"measured"},{"denominator":75,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":75,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-18T06:34:40.430872+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.01660/citation-record","integrity":"/paper/2608.01660/integrity","json":"/paper/2608.01660/citation-record.json","paper":"/paper/2608.01660"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.711810Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":"14e55a97-d198-4181-babe-e7f7ccd8a760","year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.137288Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:ee11486d822c5dd6b6614db19dde6f33dd785a2deb9c1f1d19886d84cf5afe15","observation_id":"3e07367e-ad2f-4286-8965-4b457e004f4d","resolution":{"observed_at":"2026-08-15T15:08:41.715296Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.236299Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.236299Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:eabdb4d80776ea5c223d6ad9e272b36c16e7b8fdff2261860e12970c0f486348","observation_id":"f80d940b-fb5f-4d60-b764-3c00b82a9c30","resolution":{"observed_at":"2026-08-15T15:08:37.236299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.696748Z","title":"2025 , eprint=","venue":null,"work_id":"523ef0f5-6f96-417d-b136-102ad8606c53","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.240854Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:24833d25bc485129f7c85e9a405ac662888e85b2a29c698829e491f926ed796d","observation_id":"f1d5d609-1817-430d-b93d-2502aa81b6c0","resolution":{"observed_at":"2026-08-15T15:08:41.699847Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.563052Z","title":"MovieChat+: Question-Aware Sparse Memory for Long Video Question Answering , year=","venue":null,"work_id":"d80defeb-3d86-44bd-9a3c-62b959909c92","year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.244355Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:9d73fd171eda0d7aa6c3645d54d361937c5b7759689f5b56c4291917bebd616a","observation_id":"4c8f8d32-5713-481d-8617-51a6e8426dcb","resolution":{"observed_at":"2026-08-15T15:08:41.688778Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.551197Z","title":"2026 , eprint=","venue":null,"work_id":"c1e17d45-62e1-4ed5-b39c-c00b8f7cd621","year":2026},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.248378Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:e145ddc546fdb45ecf3e64949559692da462f494a6504c95897476953affc1ac","observation_id":"30e998dd-7757-403b-a696-8cd1c87e8de0","resolution":{"observed_at":"2026-08-15T15:08:41.556579Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.257284Z","title":"Proceedings of the 21st annual international ACM SIGIR conference on Research and development in information retrieval , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.257284Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:974ab99241c7ff24558d7737713100838194a22b48ddcfcf981026ade6ed3584","observation_id":"f87b3c8b-b499-480b-986b-fe8454df5881","resolution":{"observed_at":"2026-08-15T15:08:37.257284Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.369466Z","title":"Classification Problem Solving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.369466Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:ca1b7d89052df127f9646df46bb201c82ce0a4bd98d2b6438294da2e15902a62","observation_id":"731a362f-c9ea-41f9-a974-8dfd949df099","resolution":{"observed_at":"2026-08-15T15:08:37.369466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.450358Z","title":", title =","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.450358Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:e99c21105d5d21fc7d753a9dc95ea81de10d4cf67707ca33037f02f235e73c8c","observation_id":"7fb517ed-fd23-488a-a795-59bd633fbe48","resolution":{"observed_at":"2026-08-15T15:08:37.450358Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.454244Z","title":"New Ways to Make Microcircuits Smaller---Duplicate Entry","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.454244Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:7c9741290fb2fe6e09b0204c146ac28077c5ff770bcc53bbb86c2d932e08ec61","observation_id":"bcdd3945-3806-4e5c-8143-6df7a5e58a88","resolution":{"observed_at":"2026-08-15T15:08:37.454244Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.469414Z","title":"Clancey and Glenn Rennels , abstract =","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.469414Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:c5a8d874f45d3f0ca54f794281f1ceb77330430a8ae07a8d793f78a065f6eae3","observation_id":"647134e6-4879-4caf-8f01-584f35045f15","resolution":{"observed_at":"2026-08-15T15:08:37.469414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.518806Z","title":"and Rennels, Glenn R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.518806Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:e1aee584aabd59cdb62c7bf5834f819cc0fb0e19f33871bca5bda7c5f28ceb8a","observation_id":"03e553fe-709a-4736-9ed4-5f3d6906e7b2","resolution":{"observed_at":"2026-08-15T15:08:37.518806Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.463441Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"227b2c97-0335-4c8c-89a7-450332ffe6c1","year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.537659Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:f361339d62b35f0a5c26bd32cfe77078575ce5205b03fac08acd573a5f95ed69","observation_id":"4eb3de7b-adc4-43bf-bfea-b75d9ec7ff45","resolution":{"observed_at":"2026-08-15T15:08:41.516542Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.541546Z","title":"Poligon: A System for Parallel Problem Solving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.541546Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:e97c6286c7332446dfee899e8f9500f07c7f1dd079883efd073c03d8cb570d9a","observation_id":"08d5c6c0-416a-457c-a5bd-ce61436bbdd4","resolution":{"observed_at":"2026-08-15T15:08:37.541546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.545441Z","title":"Transfer of Rule-Based Expertise through a Tutorial Dialogue","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.545441Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:f1bf4c234fa96fcd8f505c1eab8003fd8c8dceb1235d7dba2f97770d82677f0e","observation_id":"6398792e-5697-45d6-b6db-a6228abd5a73","resolution":{"observed_at":"2026-08-15T15:08:37.545441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.549013Z","title":"The Engineering of Qualitative Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.549013Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:f3cd787725fb1cc98bcd68047250f75e19f7cd065d60a861dec172ddb3c1d358","observation_id":"bbcc461a-59a8-48bd-bf56-dc6f6ae55936","resolution":{"observed_at":"2026-08-15T15:08:37.549013Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.552405Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.552405Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:4eb44cbc912f5ca0080293f110afdd314dfbf6f9541ba1ec4a2f929994acc9d7","observation_id":"80a3d2a8-78a4-4a89-9fa7-e6cf7c4a5ebe","resolution":{"observed_at":"2026-08-15T15:08:37.552405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.640023Z","title":"Pluto: The 'Other' Red Planet","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.640023Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:bf1d0e52a4401887871d413006184df7dc92bcd9bc8c54f3783bd4fd2f51535f","observation_id":"0b77ec0d-8f7f-48de-8bd0-2a1077c22345","resolution":{"observed_at":"2026-08-15T15:08:37.640023Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.424378Z","title":"Proceedings of the 19th Conference of the European Chapter of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"4f67df3e-a370-4219-8d63-422289aab13e","year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.756939Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:6912a9a948a2447bb31d893caea865bf964c03c8ac8dcbcad6891bec3d0dd84e","observation_id":"190f8748-9f09-47f7-81e2-b74a79508286","resolution":{"observed_at":"2026-08-15T15:08:41.428207Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.339738Z","title":"2025 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , year=","venue":null,"work_id":"9e7dc165-07e7-44a9-b3f3-cc1fcb373d7d","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.792374Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:8b860a754029d8fe8627d3e3eb131be67e08c24c02d9bf1c25580eba94dd600b","observation_id":"8ece195d-8ce3-4ee6-82ad-c45dc7a5738f","resolution":{"observed_at":"2026-08-15T15:08:41.417185Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.284591Z","title":"Logic-in-Frames: Dynamic Keyframe Search via Visual Semantic-Logical Verification for Long Video Understanding , url =","venue":null,"work_id":"697a8ae0-1b4d-428c-9239-18f57197abe4","year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.799515Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:6ebe4e1d8ae3ace0329ff7f079c95f7a53501c128e3fd82961fec4d9aab9f7f7","observation_id":"f6b9d767-4596-4ceb-9ac4-9f106a591760","resolution":{"observed_at":"2026-08-15T15:08:41.287918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.273372Z","title":"2025 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , year=","venue":null,"work_id":"ed7676a2-dd77-4eb6-8d74-526f20ce6eac","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.802855Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:f8ba304846d11171bc01ba4bd660004e43370a586fa4db9d5053bfb8f55766b3","observation_id":"5ff192d5-0538-4ac6-bea1-732cd5b13155","resolution":{"observed_at":"2026-08-15T15:08:41.277701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.067372Z","title":"2025 IEEE/CVF International Conference on Computer Vision (ICCV) , year=","venue":null,"work_id":"11a1e998-9983-4085-ae9c-f7766a817860","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.806918Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:3f36de88867ae915de83ba59de9bb643e6baa48195ac3c8886b2d2d83c28049d","observation_id":"bbccdefa-fb6a-4da3-af5c-978829d5e4b2","resolution":{"observed_at":"2026-08-15T15:08:41.174178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:37.810421Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.810421Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:38548e864e5079a946118bc21d73bd19e0dba5765b5f62dbe2903b546d58adea","observation_id":"69f5769f-4d62-429f-b526-2fdffa94d299","resolution":{"observed_at":"2026-08-15T15:08:37.810421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.051293Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , year=","venue":null,"work_id":"037493f7-bf03-42d4-b675-94b2a9b36c03","year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.900572Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:3a0670321c82aacf5c79ee82b0228654f892c793b9dac08264fbd9b264f1b55c","observation_id":"bd063ae0-a4e3-4387-ba09-77952f165a2f","resolution":{"observed_at":"2026-08-15T15:08:41.055167Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:41.039792Z","title":"2026 , eprint=","venue":null,"work_id":"76db160a-0e14-446f-8e92-5f8edb8b4da2","year":2026},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.949122Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:22d0e94cd04f05d1e0e174de73b05850d5a6daec4527f9f941cd821eb9952bc0","observation_id":"d3dc87d4-d1b2-40a7-b602-0dd1753bf505","resolution":{"observed_at":"2026-08-15T15:08:41.043524Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.874458Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":"2acd1127-9fa0-4c9c-bbda-e0a894ee2549","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.953951Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:18100af63c41e9a528590b64a2564ed5c5f1c898347ee908d81e8234ee54f133","observation_id":"2b627819-3db4-45ef-b362-27c4c5a7b65a","resolution":{"observed_at":"2026-08-15T15:08:40.926114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.863424Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) Findings , month =","venue":null,"work_id":"8fe56bd3-2adf-4b02-a513-0a969eee6992","year":2026},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.957665Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:511a93575cbbdcab4ea63811709656d7b0a4cc5c0217931f37510c968bea0ba1","observation_id":"cbe1ffc0-9a39-46c0-bac1-c287eff57ef1","resolution":{"observed_at":"2026-08-15T15:08:40.867359Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.853232Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":"61c1c0ee-03bc-4315-b4f9-1c27f144711e","year":2026},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.960941Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:4a844cc14ff0b8cae414e9dba8bfced06d6f90189f3ab85b40b325f16f752b95","observation_id":"a472e074-83f3-4c82-bca6-5a29eb6d07bf","resolution":{"observed_at":"2026-08-15T15:08:40.857178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.675246Z","title":"Proceedings of the 2023 conference on empirical methods in natural language processing: system demonstrations , pages=","venue":null,"work_id":"6f859f3d-f3e7-4fea-a57c-c9b736a4fc6d","year":2023},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:37.964397Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:be34c1a25f60365345d5c9bbecaeec367882e6a0a5370f5a6c3ee571f78c30d8","observation_id":"a876bf8e-81d5-4f2f-a4b4-c4fa558bb782","resolution":{"observed_at":"2026-08-15T15:08:40.769058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.010486Z","title":"Proceedings of the 2024 conference on empirical methods in natural language processing , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.010486Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:3d455bf3edc54f4eb182ffa1e0f31298f9e865b41cc1250874e53f74b4f9b263","observation_id":"d1136dfb-e2ca-467b-9357-a2659b9d3e15","resolution":{"observed_at":"2026-08-15T15:08:38.010486Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.050499Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.050499Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:a158fee338c1ed1ce888cd3cdc45bde1344ba8603d3a45792892b7b91323f8eb","observation_id":"755be9eb-1221-46d8-83ac-6ae17c683be9","resolution":{"observed_at":"2026-08-15T15:08:38.050499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.053955Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.053955Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:acd31799610af5b608e03421119e999db6a48a2b8251e6602bcf1ca365e12b26","observation_id":"4de4fe1b-bc01-438f-a749-415504653898","resolution":{"observed_at":"2026-08-15T15:08:38.053955Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.648144Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"43b172bb-23ea-48fc-9f48-a03757f68387","year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.057129Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:dccbe49cc69439b3c4797e66b382e330147063981b5d3584c6ee1ecbd1c645d3","observation_id":"c9de6a90-ad9f-4198-a57f-bb2a5ec12917","resolution":{"observed_at":"2026-08-15T15:08:40.651943Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.637977Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":"5d1e27c6-ed03-4434-8913-71c0a42e2a75","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.061226Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:e2e9685441173c62b40601b34b1fae133c78db07f99a71ef9ebbae56a7ed315f","observation_id":"02a3a939-f765-4fe5-8d5d-badca8281be6","resolution":{"observed_at":"2026-08-15T15:08:40.641702Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.066004Z","title":"European Conference on Computer Vision , pages=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.066004Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:16650c70635fb410092a7347a054df0ccde4532a9d0e1671a3f650fd8dec0d35","observation_id":"a95c83d8-96f4-429a-922a-26b4f8f5e33d","resolution":{"observed_at":"2026-08-15T15:08:38.066004Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.103769Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.103769Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:a7949102f0aa4832901f1b38435a5e7a1ee8e276cae3d0046920d23ed9e3fcdf","observation_id":"e457d4a3-4834-4943-a18f-918fa659dc98","resolution":{"observed_at":"2026-08-15T15:08:38.103769Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.606525Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":"1a003d96-a2e6-4f11-9aa2-91ed9d480e61","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.108522Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:a3f13665ac4f5cacf9a93244a637623a15dc44b72ed4a939bddf463b0463a38a","observation_id":"29b91e4b-5a26-4ecf-a580-ac19761e7bb9","resolution":{"observed_at":"2026-08-15T15:08:40.619177Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.502393Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":"a2012dbe-47b2-42f9-93f4-b7e7e89201ba","year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.112045Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:78205492bcd4caa39906d155b3bb77484e4a7aada6f57cd84e083a9a0eb5927f","observation_id":"32ad0c3f-bf94-46c8-8c1f-78e37955dde7","resolution":{"observed_at":"2026-08-15T15:08:40.554916Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.419409Z","title":"Proceedings of the IEEE/CVF International Conference on Computer Vision , pages=","venue":null,"work_id":"e31dcacd-c919-4ff0-bf2f-7d72d65d9a6f","year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.116085Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:d2ccce34f67846ca79e9a3366804e9865ce1046ea73ea0a76db69e44a20019fb","observation_id":"8c46febb-1ea0-4954-9982-edb5a21eda24","resolution":{"observed_at":"2026-08-15T15:08:40.423055Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.409242Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":"d33999f3-3185-4b27-91de-48603fdd3635","year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.120013Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:0eff3f09176e8923938e3dbaec75238d03de16a17f5ea8e24671387f6c0fa791","observation_id":"a6128d49-3434-457b-a0f0-1eff0c755f34","resolution":{"observed_at":"2026-08-15T15:08:40.412791Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.398301Z","title":"Video Summarization with Long Short-Term Memory","venue":null,"work_id":"a4e0f2d6-47fd-400e-af3a-215f1b723fc5","year":2016},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.171862Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:5bef74c0dcfe2c0e415f531aa243e1acdbc05563c9aef4f67705feb505b298cb","observation_id":"f622ae6d-5a07-41d3-a504-1e57066c6e82","resolution":{"observed_at":"2026-08-15T15:08:40.402464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.268102Z","title":"DSNet: A Flexible Detect-to-Summarize Network for Video Summarization , year=","venue":null,"work_id":"13b77f90-8c4e-4662-8252-d72c97cc7bcd","year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.216920Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:e238b35baf5557d5584dfda3afedb90060fd20ad055c460e31c906c16b6ecdbc","observation_id":"1b339b60-a989-495d-bdd3-7c3639b04889","resolution":{"observed_at":"2026-08-15T15:08:40.362731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.232663Z","title":"IEEE Transactions on Multimedia , year=","venue":null,"work_id":"f3cbf830-e62b-45ad-85cc-ac9124f98644","year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.220440Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:cd9b09d4b8f8637e48cee76f01e0dfae2c626b7d4c92a50e6d168056b0dba4c6","observation_id":"4280af97-6077-4899-9eb9-a2c3e2428c90","resolution":{"observed_at":"2026-08-15T15:08:40.236814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.224302Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.224302Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:8cd7b65e2b3aa47e4a60909e63767088e11642b7bfa637954d64b590a1049bc9","observation_id":"a02cea44-4834-4011-b474-6dbaab7c855e","resolution":{"observed_at":"2026-08-15T15:08:38.224302Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.291234Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.291234Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:e9bc166a3e75a3aa9e7393dc16c0edeb94ac04d8c21c1ea5ed9e7e9070efe6d3","observation_id":"e4813424-0ceb-42cd-95ab-a72c4bbdb84a","resolution":{"observed_at":"2026-08-15T15:08:38.291234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.025048Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR) , month =","venue":null,"work_id":"6275d685-6d97-47bf-b348-32d3e9921005","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.320191Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:102c74927b426084c301d803233021f63db9c7d2ca3143745d84054b81340414","observation_id":"487034f9-8c7f-4ede-bad8-b5b941a54730","resolution":{"observed_at":"2026-08-15T15:08:40.095211Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.323888Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.323888Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:040f356d0f97ce27e37024814d58f5ae188d3bea6aa06fde5828efd847e6d8b2","observation_id":"044124bc-e69f-46e8-b97b-010ee995a53d","resolution":{"observed_at":"2026-08-15T15:08:38.323888Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.327293Z","title":"and Han, Rilyn and Fei-Fei, Li and Xie, Saining , title =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.327293Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:a72626a8029d7f56fd2556fbbfc1fc810574b40afcf0a0e9e0ba88f16fc49187","observation_id":"baf2a62f-6102-4d3e-b124-538c6fcc3707","resolution":{"observed_at":"2026-08-15T15:08:38.327293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:40.001818Z","title":"2025 , eprint=","venue":null,"work_id":"7eeeaebc-1ce2-499b-b728-8f4f36933b59","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.331591Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:e6e7d30643794d69106b8f910aa0ba37481197eaf2e2ffb8997a4a1f58ca7c5a","observation_id":"0875204e-35ff-42b8-89fd-1d1bc0801623","resolution":{"observed_at":"2026-08-15T15:08:40.006036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.370879Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.370879Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:eb8b742d95a5e257ee9a232cdd38f335c7bcc46d9e8ab0a4c248b7703392bbb1","observation_id":"628055f0-75db-4fb1-92d2-77cb86298db7","resolution":{"observed_at":"2026-08-15T15:08:38.370879Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.420696Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.420696Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:4478f1a5da7109dcd9f3dde6a9738f7a83340ac9f4bb28d5a026006c89b3fc4e","observation_id":"6ae87d8b-7a8c-4712-a36c-41c5d8e70a2e","resolution":{"observed_at":"2026-08-15T15:08:38.420696Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13923","last_updated":"2025-02-19T18:00:14Z","snapshot_observed_at":"2026-08-14T04:17:22.593941Z","submitted_at":"2025-02-19T18:00:14Z","title":"Qwen2.5-VL Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.13923","snapshot_observed_at":"2026-08-15T15:08:38.425523Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.425523Z"},"links":{"cited_paper":"/paper/2502.13923","citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:637b8d64c53161401297b88495aedc7110a9f097202eae99b1ffef6346697091","observation_id":"095ad355-d31e-42e6-8e46-9a1ac0e03a70","resolution":{"observed_at":"2026-08-15T15:08:38.425523Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.430210Z","title":null,"venue":null,"work_id":null,"year":1998},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.430210Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:48d56da20fd41f8b27b53ec37b71305c88237beb8c6d7d2a6e4a5bfe54559695","observation_id":"4ec6e2ab-553a-45dc-aef0-18518d1d3ca6","resolution":{"observed_at":"2026-08-15T15:08:38.430210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.866150Z","title":null,"venue":null,"work_id":"8d846c1a-5a2f-4f08-975e-101f083eb476","year":2026},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.432835Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:e3fed351446a8f4f1d2caaea3ecebd28068ced8e80816074698fb9fa1896d873","observation_id":"6b71a19b-365f-48a4-9de3-854f69669728","resolution":{"observed_at":"2026-08-15T15:08:39.942750Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.855579Z","title":null,"venue":null,"work_id":"b8d98d71-2325-41f2-9de6-b69012014270","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.498126Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:69734b0a387e0a5f4540e1ada8ce7d058799da26bb2a2519adf6091920f7d766","observation_id":"fb6d0876-1523-4d31-b80d-414336e16598","resolution":{"observed_at":"2026-08-15T15:08:39.859460Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.501680Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.501680Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:1db41dafa37bfaef55b9bf30f0dd1f06d542337f5f4ce3eafee925b366ab6baf","observation_id":"5eae232a-d8a5-48bc-9ebf-1a15e34654de","resolution":{"observed_at":"2026-08-15T15:08:38.501680Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.13139","last_updated":"2025-05-17T13:22:07Z","snapshot_observed_at":"2026-08-16T12:49:22.458396Z","submitted_at":"2025-03-17T13:07:34Z","title":"Logic-in-Frames: Dynamic Keyframe Search via Visual Semantic-Logical Verification for Long Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.13139","snapshot_observed_at":"2026-08-15T15:08:38.506143Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.506143Z"},"links":{"cited_paper":"/paper/2503.13139","citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:ceff9fcebdbec680e88b17069586004eb7ae3a6a05bf1d4a1c0a880b18f4e4c8","observation_id":"b382ae23-13fc-4e43-b1bb-82ef6d08c681","resolution":{"observed_at":"2026-08-15T15:08:38.506143Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.764897Z","title":null,"venue":null,"work_id":"cc887fc1-e9c4-49ba-8848-96b553a0080e","year":2026},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.510086Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:383d10489fa5938651e52bd068cd345b10ac081fa29fda40df67bbad188cb741","observation_id":"d12aa015-26e6-4572-b517-efb079a0cbdb","resolution":{"observed_at":"2026-08-15T15:08:39.843117Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.03326","last_updated":"2024-10-26T16:35:13Z","snapshot_observed_at":"2026-08-18T11:56:50.710310Z","submitted_at":"2024-08-06T17:59:44Z","title":"LLaVA-OneVision: Easy Visual Task Transfer","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.03326","snapshot_observed_at":"2026-08-15T15:08:38.513658Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.513658Z"},"links":{"cited_paper":"/paper/2408.03326","citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:1c78080c9eb08ea66cb1357c3db754776520fa22cdb1652e17975f95e90af082","observation_id":"381cf954-3567-46fb-8117-99ec00fdf079","resolution":{"observed_at":"2026-08-15T15:08:38.513658Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.517383Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.517383Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:5657a714392c138e6b8f9af628d43de05f7e34dd5ce4824414b0168fb6170860","observation_id":"e2e61142-1020-484c-b388-4ae9353500c8","resolution":{"observed_at":"2026-08-15T15:08:38.517383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.748025Z","title":null,"venue":null,"work_id":"68c334b8-0e57-4557-8703-6c51415ca307","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.618037Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:c2db39cff4e557670e1ac9984edd8921bb2583f1e730cb9cd19ca398cc9e2693","observation_id":"21a33fce-14f1-4418-9798-8c8ba66c098f","resolution":{"observed_at":"2026-08-15T15:08:39.751712Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.738337Z","title":null,"venue":null,"work_id":"3958bbe0-e7c3-4a93-9f61-d76efa635246","year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.621710Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:38a1d1a714e6fa0eee347b9ecf8b04ef2ab8636d7a22547d3846c378c7b22dad","observation_id":"36d64ae1-cb5a-4418-aca5-3f300da8c1d0","resolution":{"observed_at":"2026-08-15T15:08:39.741430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.668893Z","title":null,"venue":null,"work_id":"80c0f426-8aa5-4cff-bd77-79823cff69c5","year":2026},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.625207Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:1b4825ce3db152a4e76a78cf859b5eefcb543671975ed831a4f2b1ae70816c90","observation_id":"fbb3f12b-3416-48e5-962a-50cfee2e3f3a","resolution":{"observed_at":"2026-08-15T15:08:39.673024Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.658529Z","title":null,"venue":null,"work_id":"b748abd9-79c3-4924-a678-a72ce449180b","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.630154Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:46babde2a650220bb82fad2d54b1165cca4512cdeb3a92833a1b292935438490","observation_id":"d24ab680-ee46-440c-8749-12b49c7398c2","resolution":{"observed_at":"2026-08-15T15:08:39.662222Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.649363Z","title":null,"venue":null,"work_id":"4b6f41bd-eb30-48d8-b8fb-ae13db76141f","year":2026},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.634381Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:21244a78cba54ddee31ed1127b0c416c7aa81a856ffe731053bbd32fda4e8582","observation_id":"0ae16a87-02bb-40df-bd00-4ed4458b3905","resolution":{"observed_at":"2026-08-15T15:08:39.652235Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.596764Z","title":null,"venue":null,"work_id":"0f120e27-e996-46fc-bc6d-466848885d99","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":67,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.744451Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:fd3e2b0a8997677c301cd01a16e53d5218df0926fb9849ce641e0318198851b1","observation_id":"4fcb77a8-dc9d-4c0f-9cdc-768e84906422","resolution":{"observed_at":"2026-08-15T15:08:39.600497Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2604.17422","last_updated":"2026-04-19T13:04:18Z","snapshot_observed_at":"2026-08-13T20:16:42.635679Z","submitted_at":"2026-04-19T13:04:18Z","title":"Where to Focus: Query-Modulated Multimodal Keyframe Selection for Long Video Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2604.17422","snapshot_observed_at":"2026-08-15T15:08:38.813415Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":68,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.813415Z"},"links":{"cited_paper":"/paper/2604.17422","citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:f73748a640221464af212e9a6cad5097397296b2b33ae7195ead3f139f257142","observation_id":"88791888-b073-4630-b756-7d033096f2b4","resolution":{"observed_at":"2026-08-15T15:08:38.813415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.585941Z","title":null,"venue":null,"work_id":"df5f8dde-5f71-4d18-8488-7b48358e566c","year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.818920Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:abae3731d0a698de7b00792980d6192d6d4e76f4209eb6d7fe47959e06f6e1de","observation_id":"8677b137-e454-49a3-8fc4-0ba484fe82ad","resolution":{"observed_at":"2026-08-15T15:08:39.590616Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.505302Z","title":null,"venue":null,"work_id":"8583b60a-3087-4d9b-90f4-9edb60dce8ae","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":70,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.822766Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:f8fbc83908c290aa65c5fbc3fcf4dc55370752f7f352d240a4191e1a805a42ce","observation_id":"a6bff458-a54b-4c55-bb7d-d4cb1917c3c3","resolution":{"observed_at":"2026-08-15T15:08:39.553321Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:38.827139Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":71,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.827139Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:d72d12e318dec218004f176590bcab666fc6dd37b08b75178348abf28fe971cd","observation_id":"c171ed28-6573-459d-8bb4-8da2e75989bb","resolution":{"observed_at":"2026-08-15T15:08:38.827139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.432670Z","title":null,"venue":null,"work_id":"b376810b-4ee6-443e-877d-ddd14ec67d5d","year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":72,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.906682Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:9b68ccd7122a091fa5509f3b1a7ec934ec6d387256991528a404f53df1006cc0","observation_id":"e70afab0-02a9-4ba5-bbf9-a8de4aaf6eae","resolution":{"observed_at":"2026-08-15T15:08:39.491721Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.05917","last_updated":"2026-06-04T09:23:31Z","snapshot_observed_at":"2026-08-04T03:04:58.385559Z","submitted_at":"2026-06-04T09:23:31Z","title":"MemoryCard: Topic-Aware Multi-Modal Clue Compression for Long-Video Question Answering","version":1},"cited_work":{"arxiv_id":"2606.05917","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.05917","snapshot_observed_at":"2026-08-15T15:08:39.099298Z","title":"MemoryCard: Topic-Aware Multi-Modal Clue Compression for Long-Video Question Answering","venue":"cs.CV","work_id":"656a508b-703d-4a8b-9c64-5687cca22d7e","year":2026},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":73,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.973063Z"},"links":{"cited_paper":"/paper/2606.05917","citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:bbbe572099461776ec38129955beda512eb1659795cd897d7f5f8b9eda9b3b46","observation_id":"90499b80-f861-415c-bcd5-1beff92be612","resolution":{"observed_at":"2026-08-15T15:08:39.183218Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T15:08:39.341685Z","title":"C.; Adeli, E.; Li, F.-F.; Wu, J.; and Li, M","venue":null,"work_id":"bd46b25a-2c78-4d1c-8620-5899687ac847","year":2025},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":74,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.978117Z"},"links":{"citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:827699452d3da3b707e4893d3457264c0ecc40affa38a78e21676b61fadcc849","observation_id":"29d4acbd-38bb-4148-8f5b-cd22878cb88c","resolution":{"observed_at":"2026-08-15T15:08:39.395109Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-18T06:34:40.430872+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15343","last_updated":"2023-09-27T12:05:41Z","snapshot_observed_at":"2026-07-06T15:08:30.190912Z","submitted_at":"2023-03-27T15:53:01Z","title":"Sigmoid Loss for Language Image Pre-Training","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.15343","snapshot_observed_at":"2026-08-15T15:08:38.981773Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":75,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.981773Z"},"links":{"cited_paper":"/paper/2303.15343","citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:e2e37a00e54cac0b4bccd063056677896c81e8a453f1ca61055c0dcc654dd067","observation_id":"b4d4bf7c-f593-4ed1-9dac-15e6d61e0d9c","resolution":{"observed_at":"2026-08-15T15:08:38.981773Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-02T12:24:31.329178Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.02713","snapshot_observed_at":"2026-08-15T15:08:38.986063Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering","version":1},"reference_index":76,"source":"arxiv_source","source_observed_at":"2026-08-15T15:08:38.986063Z"},"links":{"cited_paper":"/paper/2410.02713","citing_paper":"/paper/2608.01660"},"observation_digest":"sha256:2e564f5609b520656ae7f498bb592bc6920f908c872cc425f76c97d8a313030c","observation_id":"4c9df4ee-33a4-48cc-8ebb-15aa8ab5d755","resolution":{"observed_at":"2026-08-15T15:08:38.986063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.01660","last_updated":"2026-08-03T03:50:22Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T15:03:30.786061Z","submitted_at":"2026-08-03T03:50:22Z","title":"Ground, Cover, and Refine: Evidence-Centric Frame Selection for Long-Video Question Answering"},"reference_resolution":{"displayed":75,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":75},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-18T06:34:40.430872+00:00","source":"crossref"},{"observed_at":"2026-08-18T06:34:34.496301+00:00","source":"retraction_watch"}],"thesis":"As of 18 August 2026, this Paper Citation Record lists 75 of 75 outbound references and 0 inbound Pith citation observations for arXiv:2608.01660."}