{"as_of":"2026-08-04T21:24:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7b6a2d14713e7f8c3c193831f1fe5432932b3d7a1e9a2b9f3c7e05632d3bac2a","coverage":[{"denominator":45,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":45,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-20T15:12:00.408851Z","state":"measured"},{"denominator":45,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":45,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.17065/citation-record","integrity":"/paper/2605.17065/integrity","json":"/paper/2605.17065/citation-record.json","paper":"/paper/2605.17065"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1146/annurev-psych-010419-051101","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Annual Review of Psychology , volume=","venue":null,"work_id":"502b1b94-ab04-47f0-829f-dd951d6bc505","year":2020},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:2fbb1e6e259ffe2090f3012dd54afe7c010bc320d9da603248364ad0a456b13d","observation_id":"42ec9102-c022-49c2-804a-5ea93122118c","resolution":{"observed_at":"2026-05-20T15:13:24.748071Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T18:23:19.566479+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T18:23:19.566479+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"c4c50e43-1eee-4775-9dd8-13252293baf8","year":2024},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:b885d758ca126d8629b8b5cd1bafd1dfe015b5463501558d06a8a49ba385fd96","observation_id":"f7b4cef8-8c12-45d9-8e2c-43eed75bbfe4","resolution":{"observed_at":"2026-05-20T15:13:25.292444Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"ec614eee-0eaf-4b15-8f18-224e3c70e6bc","year":2024},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:f1b40799b8c221dfc34b2f572756d653c11729f7e7eb90f70c2a7f7b106a097f","observation_id":"dc20c951-1b38-4fe4-a548-678a6ef4dbee","resolution":{"observed_at":"2026-05-20T15:13:25.263046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"d5808834-5460-43c9-97f9-0edf996a1c08","year":2024},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:4fcd262338c769315d9202df4b376280cbe99b9e6c2acfadc2ba5b439a5d4381","observation_id":"f8ce225c-eabf-4feb-90bd-ba058e778a1d","resolution":{"observed_at":"2026-05-20T15:13:25.294785Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"78540735-4afc-4dc4-bebd-76401bcc45bf","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:887ed0f80a6692582e686754c2f7a86621f7bf159b2a1e045b3fd65aae11a2f9","observation_id":"c1223c2c-51d1-462d-babf-9a19acae59b4","resolution":{"observed_at":"2026-05-20T15:13:25.283594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"56de1ebe-17a6-4589-ad43-78c85c71f2ba","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:e8ccfd44a9d892b856b38e266afb27744fe5dbddccd7e6f7c92f4c7c0d15991d","observation_id":"02b989f5-dfc9-4551-81fd-854a4a795952","resolution":{"observed_at":"2026-05-20T15:13:25.285481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":"6d0b2bda-e71f-4f02-a596-1ce56ebed77c","year":null},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:4033003002bed1b1adfe59bd6f4915c97af54d0b85d4398e2f61f510d2b33912","observation_id":"4020afcf-32c1-4768-83dc-8981b62e017e","resolution":{"observed_at":"2026-05-20T15:13:25.287387Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"96c77d07-cbae-420c-b100-ba3220cab696","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:bcf6f140d2862d3a6afcb883ba35bfc75347002716a02a569442717c13972568","observation_id":"31a7093c-ef66-42da-8a25-825f229a192a","resolution":{"observed_at":"2026-05-20T15:13:25.290008Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-08T20:25:37.789633Z","title":"2025 , eprint=","venue":null,"work_id":"e95c764f-e503-4fbc-8ac0-3f1a835938c7","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:2fe5652e23375c811067baa526e8f5f525f046759a65da335453e4b63177e169","observation_id":"94d74df5-3682-4ff7-83fd-22283d4a42af","resolution":{"observed_at":"2026-05-20T15:13:25.299871Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2023 , eprint=","venue":null,"work_id":"76ad59ac-98a0-4471-bb18-f48b35066e3d","year":2023},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:347d77f9d1515a7941de2e623212db573883c906b15fa57a327954155d4b2ff6","observation_id":"69beee70-6930-464a-8dfb-ed1b09a1a145","resolution":{"observed_at":"2026-05-20T15:13:25.277889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"d5935338-318a-4508-acaa-123f10a6dddb","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:70569efbeeef87c6168d74a6a5c48aa118ba225d4558e87ce6bcf4453da3c55e","observation_id":"4f44beb9-20df-4497-a33f-746d7aed55ae","resolution":{"observed_at":"2026-05-20T15:13:25.281658Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2024 , eprint=","venue":null,"work_id":"d0c58d7d-e9fb-4407-a6bc-19eb28f785ee","year":2024},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:0afc67875b2de076bc64e63b50d4f11d80830bebcaff77ba8b23337b62636d03","observation_id":"607b0158-9752-4ccb-bfa7-87269aa17cb4","resolution":{"observed_at":"2026-05-20T15:13:25.265032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"64846699-a923-4ae0-8d53-5a515246f65c","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:4d7ca44cf8f171c6fb54019f44d0cd19083d86fa3f149e97c47ee541fb9590f0","observation_id":"a95024e3-ae14-4393-b5a8-6a95acb7cfba","resolution":{"observed_at":"2026-05-20T15:13:25.267009Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"4528200f-6aec-44f7-bcb2-c6b309c898b4","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:b2545258ac481aabd866b25bb01d3b02d31c2d0864724443b08782193a123302","observation_id":"3ff04637-5d34-4cb5-a3de-46af0e609eb8","resolution":{"observed_at":"2026-05-20T15:13:25.271855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"d0203b6c-8a49-4607-b422-1eed064b3ca1","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:39471670ac6f86e916fdbae47258b4aaac7fd12793f393567133f328b9668437","observation_id":"8f03403d-4b02-43d5-962c-5382526d17b7","resolution":{"observed_at":"2026-05-20T15:13:25.273719Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T01:31:45.197680Z","title":"2025 , eprint=","venue":null,"work_id":"c2b90839-0f57-40ad-a8e1-80f94f1b52e1","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:36ab2e1e54b72ee31c8e53ba9332aca52cccd17546f961af342ddf27e11081c4","observation_id":"65662834-95b8-4763-8221-eae9007f7138","resolution":{"observed_at":"2026-05-20T15:13:25.275926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T18:21:22.524685Z","title":"2025 , eprint=","venue":null,"work_id":"da9c6cc2-0ff6-4df8-86bc-8e04bb59a065","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:474df27c411ebd2b8637324f4f605d4c17bc722771a721682460a0c8d4e09d70","observation_id":"e0fc0a28-4f40-480d-85ba-435ee5b640c6","resolution":{"observed_at":"2026-05-20T15:13:25.306878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"81796547-41e1-42bc-b91f-97fe8ce17958","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:af3596a8b3e88404ac58b08b4241f344b1dec6ee5679400e9becb732e773db30","observation_id":"10d0a03e-2f7e-4c59-bec1-9382b6052164","resolution":{"observed_at":"2026-05-20T15:13:25.269254Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-05T18:21:22.513141Z","title":"2025 , eprint=","venue":null,"work_id":"9daa51c5-7c93-491a-969b-cdae18e57978","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:e2eb769c54d4b02c457c6363af08510ff111d842a5fb104e47546f0a7416a336","observation_id":"f9538269-1c1b-4a4c-95d2-16f43fadb10a","resolution":{"observed_at":"2026-05-20T15:13:25.309257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T11:56:12.804296Z","title":"2026 , eprint=","venue":null,"work_id":"b15081c4-1b29-40a8-a6df-fe1386eb1d2a","year":2026},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:e3e029a064148adec82b531464a585689da85e05867191a4f50a9cb755c8a93c","observation_id":"7247d048-57b8-4329-9bdb-6eeb6a0bbd96","resolution":{"observed_at":"2026-05-20T15:13:25.304191Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"2025 , eprint=","venue":null,"work_id":"62146d45-e5ae-4280-ae0b-ac201fed4a1b","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:7ed66167d3df7f87db962ce5f3f47fdb94a2295597c17488de973ae9cb701d40","observation_id":"e6b4f5af-b133-4902-a2c7-d595ccb0bbb7","resolution":{"observed_at":"2026-05-20T15:13:25.301999Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":"2511.21631","doi":"10.1016/j.neunet.2025.107777","metadata_source":"pith","pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3-VL Technical Report","venue":"cs.CV","work_id":"1fe243aa-e3c0-4da6-b391-4cbcfc88d5c0","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:bdbed61f693b064bdc6ba66f3f0f7937111f532ff7b59bc81c0d74d0f4259ad4","observation_id":"6fb1e1fc-be39-4535-8f21-a621531934bd","resolution":{"observed_at":"2026-05-20T15:13:24.762998Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":"2504.19413","doi":"10.48550/arxiv.2504.19413","metadata_source":"pith","pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-07-11T03:27:46.512344Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","venue":"cs.CL","work_id":"a5aed26c-a248-48b6-a59e-f7693fcb180a","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:38c54514a60db5417f7a7d6df8e7145b47d192084c2a5b82e4d74dd9916eca3a","observation_id":"d702be86-2d52-4ab6-b71d-ebaaab5f1db3","resolution":{"observed_at":"2026-05-20T15:13:24.831736Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.06261","last_updated":"2025-12-19T14:25:46Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-07-07T17:36:04Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","version":6},"cited_work":{"arxiv_id":"2507.06261","doi":"10.48550/arxiv.2503.19","metadata_source":"pith","pith_arxiv_id":"2507.06261","snapshot_observed_at":"2026-07-11T03:17:51.364436Z","title":"Gemini 2.5: Pushing the Frontier with Advanced Reasoning, Multimodality, Long Context, and Next Generation Agentic Capabilities","venue":"cs.CL","work_id":"008df105-2fdd-45d8-857a-8e35868aecb6","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2507.06261","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:8455c25eddcb65168dac837a495914bec9c3ce84f4329e470a2a5858973d3bdd","observation_id":"297bc5b2-cf06-4e0e-847c-0bb877110258","resolution":{"observed_at":"2026-05-20T15:13:24.827225Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":"2405.21075","doi":"10.1609/icwsm.v17i1.22209","metadata_source":"pith","pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","venue":"cs.CV","work_id":"77fd5ac9-ae98-4846-9d83-e9c73c8f2a52","year":2024},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:71f20c452bc8102509ea8fba4568c476b59a11c68c602d5f51c00a04ede3dcdd","observation_id":"fe6a05ae-2b8f-4b51-a7c0-5013f4b314ed","resolution":{"observed_at":"2026-05-20T15:13:24.844677Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.05726","last_updated":"2024-04-24T15:38:48Z","snapshot_observed_at":"2026-07-06T17:57:19.117933Z","submitted_at":"2024-04-08T17:59:24Z","title":"MA-LMM: Memory-Augmented Large Multimodal Model for Long-Term Video Understanding","version":2},"cited_work":{"arxiv_id":"2404.05726","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2404.05726","snapshot_observed_at":"2026-07-04T06:39:37.683925Z","title":"Ma-lmm: Memory-augmented large multimodal model for long-term video understanding","venue":null,"work_id":"62c573d1-70ae-4dc5-8e9e-22a02757d58b","year":2024},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2404.05726","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:8c3393f4b8b7a13ffa9aef88246a2e1d6641bf885107024e08b0bdd06fb9be33","observation_id":"bb49de16-191a-4ae0-9658-6af5cbc4c952","resolution":{"observed_at":"2026-05-20T15:13:24.819686Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.09559","last_updated":"2024-08-18T17:59:49Z","snapshot_observed_at":"2026-07-06T19:02:11.267510Z","submitted_at":"2024-08-18T17:59:49Z","title":"HiAgent: Hierarchical Working Memory Management for Solving Long-Horizon Agent Tasks with Large Language Model","version":1},"cited_work":{"arxiv_id":"2408.09559","doi":"10.48550/arxiv.2408.09559","metadata_source":"arxiv_reference","pith_arxiv_id":"2408.09559","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Hiagent: Hierarchical working memory management for solving long-horizon agent tasks with large language model","venue":null,"work_id":"bf5ea8ae-3cb8-49b6-b19b-4a49bbc341e4","year":2024},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2408.09559","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:b4f808f7a99c3367227fcf710ec5a3e8f222d4db9b5f19559a6d7ffa55299eba","observation_id":"7e139afc-af09-4b66-bf73-16bc0b1c4b9d","resolution":{"observed_at":"2026-05-20T15:13:24.812548Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.05520","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cam: A constructivist view of agentic memory for llm-based reading comprehension","venue":null,"work_id":"38c07cc8-f361-4230-b523-c69651a5db7e","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:f3657469fdcecd534bcbc3a08cd7bcb0cd81f02ccec7ff0cbf6001e4a6da5b3c","observation_id":"a918a161-e2b3-4095-b21e-e92949b0cfeb","resolution":{"observed_at":"2026-05-20T15:13:24.854635Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.00574","last_updated":"2025-07-13T16:21:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-31T18:01:23Z","title":"VideoChat-Flash: Hierarchical Compression for Long-Context Video Modeling","version":4},"cited_work":{"arxiv_id":"2501.00574","doi":null,"metadata_source":"pith","pith_arxiv_id":"2501.00574","snapshot_observed_at":"2026-07-04T16:49:57.265026Z","title":"VideoChat-Flash: Hierarchical Compression for Long-Context Video Modeling","venue":"cs.CV","work_id":"52ec7cb6-1ef6-4366-a43f-d4c13fce23ad","year":2024},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2501.00574","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:c9980a45a65584bab5ce5939b98f0642bef83d13e08ffc97e931dcb3ddd75219","observation_id":"ec812b9c-1654-49bd-9cb1-e7a4964b0231","resolution":{"observed_at":"2026-05-20T15:13:24.794852Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.22101","last_updated":"2025-05-28T08:27:12Z","snapshot_observed_at":"2026-07-06T21:31:59.333003Z","submitted_at":"2025-05-28T08:27:12Z","title":"MemOS: An Operating System for Memory-Augmented Generation (MAG) in Large Language Models","version":1},"cited_work":{"arxiv_id":"2505.22101","doi":"10.48550/arxiv.2505.22101","metadata_source":"pith","pith_arxiv_id":"2505.22101","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"MemOS: An operating system for memory-augmented generation","venue":"cs.CL","work_id":"62f802d2-2c22-4140-9b3d-b8b7220f772e","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2505.22101","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:ac30408bc1c17e735a363cbfcc320c6de317b8e83cac01f0fd0d224c1e378a3b","observation_id":"4ead952f-689a-4430-bfbf-eaf4df9dbe01","resolution":{"observed_at":"2026-05-20T15:13:24.823523Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2504.10739","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-29T00:12:50.458794Z","title":"Hippomm: Hippocampal-inspired multimodal memory for long audiovisual event understanding.arXiv preprint arXiv:2504.10739","venue":null,"work_id":"0503e3ae-c7bc-47ad-93aa-54678002ebc5","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:84fb24d94abb334bde2f8cadaa2862da5cb31908337d42d8aefb368bfc98ec2c","observation_id":"daf88729-e498-4939-8f00-26864a67d3dd","resolution":{"observed_at":"2026-05-20T15:13:24.851481Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.09736","doi":"10.48550/arxiv.2508.09736","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Seeing, listening, remembering, and reasoning: A multi- modal agent with long-term memory","venue":null,"work_id":"4e96e6d1-1009-4e40-bbfe-9317a90452ab","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:00ce7bfd9cbecab63a0531d63be8b26dc4c264508686796f31f44e58c50de0df","observation_id":"a8d17ba9-a910-4b3d-8768-20ce3756107c","resolution":{"observed_at":"2026-05-20T15:13:24.790945Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T09:19:47.876951+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T09:19:47.876951+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.23990","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T14:59:55.994975Z","title":"Perez-Cabarcas, Utteja Kallakuri, Nicholas R","venue":null,"work_id":"f2756ee6-4814-4fce-86b8-b155d88accca","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:a29dceb42602f1d76c1f9768be10f7d322326d0ebc4f10dd245db22d74a9102e","observation_id":"b7710273-bf49-4971-ba8d-2baf6e02d3b2","resolution":{"observed_at":"2026-05-20T15:13:24.801771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.13956","last_updated":"2025-01-20T16:52:48Z","snapshot_observed_at":"2026-07-29T15:53:45.545304Z","submitted_at":"2025-01-20T16:52:48Z","title":"Zep: A Temporal Knowledge Graph Architecture for Agent Memory","version":1},"cited_work":{"arxiv_id":"2501.13956","doi":"10.48550/arxiv.2501.13956","metadata_source":"pith","pith_arxiv_id":"2501.13956","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"Zep: A Temporal Knowledge Graph Architecture for Agent Memory","venue":"cs.CL","work_id":"515c933e-12ae-439d-a7ff-c07fee482dfb","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2501.13956","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:8a1dec050d5e5562c92a7054b47df0eb837864eea398be6bc407ad0df79f40ce","observation_id":"644c16fd-8c75-4624-8764-900d7b2e1ecf","resolution":{"observed_at":"2026-05-20T15:13:24.837969Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16449","last_updated":"2024-03-09T06:43:37Z","snapshot_observed_at":"2026-07-06T16:00:29.832559Z","submitted_at":"2023-07-31T07:15:45Z","title":"MovieChat: From Dense Token to Sparse Memory for Long Video Understanding","version":4},"cited_work":{"arxiv_id":"2307.16449","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.16449","snapshot_observed_at":"2026-07-10T01:36:44.033728Z","title":"Moviechat: From dense to- ken to sparse memory for long video understanding","venue":"cs.CV","work_id":"fd5baba2-50a7-4f10-894a-b2f08c7e6660","year":2023},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2307.16449","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:a44bffb92a12bb05cdf788e23194494ec68b3b25ca57bb55995623a5517328aa","observation_id":"7aeb8240-0e45-4502-b046-84e21d5d72cc","resolution":{"observed_at":"2026-05-20T15:13:24.841282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08035","last_updated":"2025-08-09T10:54:59Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-12T09:36:52Z","title":"LVBench: An Extreme Long Video Understanding Benchmark","version":3},"cited_work":{"arxiv_id":"2406.08035","doi":null,"metadata_source":"pith","pith_arxiv_id":"2406.08035","snapshot_observed_at":"2026-07-04T16:09:57.146670Z","title":"LVBench: An Extreme Long Video Understanding Benchmark","venue":"cs.CV","work_id":"e9bfdf40-cd28-4d57-98b8-31b7e97f9f2f","year":2024},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2406.08035","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:9f95f508bd02f23e6e090e8f7de2bb6c49fc66e03f48890593afb4bb5ee0e7aa","observation_id":"acfb45d7-82bf-4f9b-baf8-d99d0cbdea3b","resolution":{"observed_at":"2026-05-20T15:13:24.834935Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07957","last_updated":"2025-07-10T17:40:11Z","snapshot_observed_at":"2026-08-02T05:16:27.995066Z","submitted_at":"2025-07-10T17:40:11Z","title":"MIRIX: Multi-Agent Memory System for LLM-Based Agents","version":1},"cited_work":{"arxiv_id":"2507.07957","doi":"10.48550/arxiv.2507.07957","metadata_source":"pith","pith_arxiv_id":"2507.07957","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"MIRIX: Multi-Agent Memory System for LLM-Based Agents","venue":"cs.CL","work_id":"bcb99885-6f76-4bd6-b442-e5f455bb6447","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2507.07957","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:6841103f5f5c8f77288fb7a0c6518f904f1bf1a867be378c586efa30f71d4639","observation_id":"6f4c2888-9d82-4e2a-b1f0-68f79f9169ff","resolution":{"observed_at":"2026-05-20T15:13:24.785091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.25911","last_updated":"2025-09-30T08:02:34Z","snapshot_observed_at":"2026-07-06T22:31:15.349221Z","submitted_at":"2025-09-30T08:02:34Z","title":"Mem-{\\alpha}: Learning Memory Construction via Reinforcement Learning","version":1},"cited_work":{"arxiv_id":"2509.25911","doi":"10.48550/arxiv.2509.25911","metadata_source":"pith","pith_arxiv_id":"2509.25911","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Mem-{\\alpha}: Learning Memory Construction via Reinforcement Learning","venue":"cs.CL","work_id":"4643330b-80ff-49a5-bbb1-e618edaffe35","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2509.25911","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:a4ae6e36728a7d6ef8c5e7531bb143820d59ae1c737e566ece0e975f2c0e0dad","observation_id":"213ffd68-d184-407e-8849-10b860aa8549","resolution":{"observed_at":"2026-05-20T15:13:24.766395Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-17T20:50:53.619604+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-17T20:50:53.619604+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"00e7ad5c-c9d5-4357-aef2-a1001ee15551","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:bf958c9d93ce0fa2f1b1f34e6efa37294690304a6ca8ddfe762da2e701f2f4a5","observation_id":"8c882c39-9a72-4206-a375-ca88e89bb8b9","resolution":{"observed_at":"2026-05-20T15:13:25.297678Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12110","last_updated":"2025-10-08T01:46:37Z","snapshot_observed_at":"2026-08-03T02:27:06.991396Z","submitted_at":"2025-02-17T18:36:14Z","title":"A-MEM: Agentic Memory for LLM Agents","version":11},"cited_work":{"arxiv_id":"2502.12110","doi":"10.48550/arxiv.2502.12110","metadata_source":"pith","pith_arxiv_id":"2502.12110","snapshot_observed_at":"2026-07-11T03:27:46.348461Z","title":"A-MEM: Agentic Memory for LLM Agents","venue":"cs.CL","work_id":"3b98feb2-fdb1-479a-bbe4-2c298a4592e2","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2502.12110","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:6fc25d74061b48bfc2289e38bf12eb67a6066d0421021c02d76b9a4032a1041b","observation_id":"240748e8-5ef0-4739-8a45-0694d5fa5b57","resolution":{"observed_at":"2026-05-20T15:13:24.804860Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.19828","last_updated":"2026-01-14T14:21:21Z","snapshot_observed_at":"2026-07-06T22:19:28.487854Z","submitted_at":"2025-08-27T12:26:55Z","title":"Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning","version":5},"cited_work":{"arxiv_id":"2508.19828","doi":"10.48550/arxiv.2508.19828","metadata_source":"pith","pith_arxiv_id":"2508.19828","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"Memory-R1: Enhancing Large Language Model Agents to Manage and Utilize Memories via Reinforcement Learning","venue":"cs.CL","work_id":"2a070440-2167-4398-be97-c2d4c3ee3541","year":2025},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2508.19828","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:ddde237d216a89c07d4462c391ea412ba6d1572a959c80535eff131fbcf07b13","observation_id":"eec704c2-f044-4fc3-bd50-bcfb8ac67fed","resolution":{"observed_at":"2026-05-20T15:13:24.847942Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-13T15:49:35.802766+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T15:49:35.802766+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2601.23014","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T18:30:01.298309Z","title":"Mem-t: Densifying rewards for long-horizon memory agents","venue":null,"work_id":"48b35e7e-53f6-4063-9528-01fcbc9a1920","year":2026},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:61ae73ff7b286f2e6156bd091ae59085e0e1fd23d3f9514e2689d1fd28a7d425","observation_id":"0c308fa5-284b-4158-9c5f-0f6be4c1cef0","resolution":{"observed_at":"2026-05-20T15:13:24.808871Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.1037/0033-2909.133.2.273","metadata_source":"doi_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-03T13:28:18.121965Z","title":"Zacks, Nicole K","venue":null,"work_id":"4283b128-751f-4bdf-9192-c28811e8f8a3","year":2007},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:f451727137974048e53cc32e73fc9d7efb6a32afe786220274f027c2727e0fd8","observation_id":"c5c23b4f-bde1-44b6-b489-a2e609888cab","resolution":{"observed_at":"2026-05-20T15:13:24.745848Z","resolver_source":"doi","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-05-23T18:23:19.914044+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T18:23:19.914044+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08085","last_updated":"2024-06-30T05:39:46Z","snapshot_observed_at":"2026-08-03T12:09:02.990658Z","submitted_at":"2024-06-12T11:07:55Z","title":"Flash-VStream: Memory-Based Real-Time Understanding for Long Video Streams","version":2},"cited_work":{"arxiv_id":"2406.08085","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.08085","snapshot_observed_at":"2026-07-04T20:00:08.182505Z","title":"Flash-vstream: Memory-based real-time understanding for long video streams","venue":null,"work_id":"f53e5fea-3444-480b-aa38-be98378c0ced","year":2024},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2406.08085","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:8ef6b5d81bcba3b9d7adb02df86ebdae3efe2ae2610efa06905d6df2043792e6","observation_id":"eb91be19-68ab-41e9-ba79-cff4ed9f0561","resolution":{"observed_at":"2026-05-20T15:13:24.798248Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.10250","last_updated":"2023-05-21T06:20:28Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-17T14:40:29Z","title":"MemoryBank: Enhancing Large Language Models with Long-Term Memory","version":3},"cited_work":{"arxiv_id":"2305.10250","doi":"10.48550/arxiv.2305.10250","metadata_source":"pith","pith_arxiv_id":"2305.10250","snapshot_observed_at":"2026-07-10T06:15:00.866473Z","title":"MemoryBank: Enhancing Large Language Models with Long-Term Memory","venue":"cs.CL","work_id":"3f0e5fbe-8eb1-48c4-9e30-cf41428c3046","year":2023},"citing_paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning","version":1},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-05-20T15:12:00.408851Z"},"links":{"cited_paper":"/paper/2305.10250","citing_paper":"/paper/2605.17065"},"observation_digest":"sha256:802456ef8481e69a3d1baa1c10b9f4b70b564ce85f347b4d22e66e80219358be","observation_id":"a97a3bd7-1e1c-4b68-8543-175ae7ac6dc3","resolution":{"observed_at":"2026-05-20T15:13:24.816021Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.17065","last_updated":"2026-05-16T16:15:59Z","latest_version":1,"primary_category":"cs.MA","snapshot_observed_at":"2026-08-02T03:22:29.983512Z","submitted_at":"2026-05-16T16:15:59Z","title":"PyraVid: Hierarchical Multimodal Memory for Long-Horizon Video Reasoning"},"reference_resolution":{"displayed":45,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":1,"verified_exact":23,"verified_fuzzy":20},"total_outbound_references":45},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 45 of 45 outbound references and 0 inbound Pith citation observations for arXiv:2605.17065."}