{"as_of":"2026-08-08T17:12:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3267c79e55e0f1080474b09755f6b11e0b9a32261502fd51d25ba0a197d51924","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T00:45:22.048780Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28678/citation-record","integrity":"/paper/2607.28678/integrity","json":"/paper/2607.28678/citation-record.json","paper":"/paper/2607.28678"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-03T00:45:17.822600Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:17.822600Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:0018c58dc6b82ab5a8b5ba1466fc395f355776bcf425ae90768b7bc132e533ca","observation_id":"df55f38e-1725-4387-847a-c285d2669e22","resolution":{"observed_at":"2026-08-03T00:45:17.822600Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.10188","last_updated":"2024-12-13T02:32:06Z","snapshot_observed_at":"2026-08-05T14:57:53.592979Z","submitted_at":"2024-08-19T17:48:08Z","title":"LongVILA: Scaling Long-Context Visual Language Models for Long Videos","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.10188","snapshot_observed_at":"2026-08-03T00:45:17.837663Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:17.837663Z"},"links":{"cited_paper":"/paper/2408.10188","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:3ad3cdc503552824ebd20b9ad600afa48a4142a3651a1643dd15e902916e6d54","observation_id":"dc18cbab-4a4b-40ed-a815-ea95be6e4c11","resolution":{"observed_at":"2026-08-03T00:45:17.837663Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:17.853440Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:17.853440Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:3c15e17854073d855ea7127d55f267c8cfaa13a7f98bbdd12b496670ae36767c","observation_id":"a0e92c54-0599-4d1a-b427-72b081ec25ca","resolution":{"observed_at":"2026-08-03T00:45:17.853440Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:17.908465Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:17.908465Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:acadb2ea4fa73f27b3a7f92e9bbfcadd6709c3a53555e6aeb9d0d5abc1dc7ae1","observation_id":"7111aa4f-149b-4984-8503-16a44c437dc5","resolution":{"observed_at":"2026-08-03T00:45:17.908465Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:18.008615Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:18.008615Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:296966f488faf765a6c7520654a46afcb65ed4bc506e6cd1bc4594f717d0207c","observation_id":"a88359dc-20f2-484d-b4d0-57859bc8db0e","resolution":{"observed_at":"2026-08-03T00:45:18.008615Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:17.939271Z","title":"InProceedings of the IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:17.939271Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:18f79e1ea276bee1655d9c04129b5543f86ee222310017fd8335d1482af38b85","observation_id":"34b0e845-e9fd-4e06-9712-c469a383e22d","resolution":{"observed_at":"2026-08-03T00:45:17.939271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.22355","last_updated":"2025-07-07T15:42:11Z","snapshot_observed_at":"2026-08-07T04:25:28.195802Z","submitted_at":"2025-06-27T16:05:34Z","title":"Embodied AI Agents: Modeling the World","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.22355","snapshot_observed_at":"2026-08-03T00:45:18.191687Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:18.191687Z"},"links":{"cited_paper":"/paper/2506.22355","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:87c5d26ca94b8d29c0f1fd58a8ac84cb056943c320a0ad52893dcc97aa53e95d","observation_id":"70a821cb-841f-4a31-b55b-d9a188880cfa","resolution":{"observed_at":"2026-08-03T00:45:18.191687Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:18.094889Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:18.094889Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:aad6a4e1457875eb6668800156bb3582ccf23b72b9aaaf7e4860fe1c5e7e1a10","observation_id":"c3590091-f673-466e-aca0-c38b5e086cd4","resolution":{"observed_at":"2026-08-03T00:45:18.094889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:18.422289Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:18.422289Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:b51ceb739a69880686e72a1bed6f0d80e476903c2f0022257b9a54f0e3e47b1c","observation_id":"256be746-5592-4716-b63b-9a7375fe2b0f","resolution":{"observed_at":"2026-08-03T00:45:18.422289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-03T00:45:18.306255Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:18.306255Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:31f040bd2f4cec6037f046467ef5809d1af6a31c9ccb8d7083141a3d8fa1e26a","observation_id":"45164063-0a22-42e1-83f9-259b8eaa83ab","resolution":{"observed_at":"2026-08-03T00:45:18.306255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:18.617392Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:18.617392Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:bddea007d66937f039938f2263b02385aa32f84dc53ea3d64ba8666eafd117f8","observation_id":"8d411be5-0fef-46d8-9043-1c2edf7d5ec6","resolution":{"observed_at":"2026-08-03T00:45:18.617392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:18.521525Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:18.521525Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:efccd85fbc32754221875af1029057b6185f2b0bc178f384c8947cc0153f44d3","observation_id":"6c4cc2f9-60a0-416c-afb7-3c7cf66cda9e","resolution":{"observed_at":"2026-08-03T00:45:18.521525Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:18.960436Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:18.960436Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:54fbf34e55b1ab307c086575af2e1eda1f1fb85cad81b74c3c7b1cd71e0ff9c4","observation_id":"019d4fb0-7dd2-46dd-b558-619689ad6e4e","resolution":{"observed_at":"2026-08-03T00:45:18.960436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:18.841065Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:18.841065Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:cf57251395f4428e7f124c175a68d6b313bc03aa276a1b7ebb4c0b62a5e64821","observation_id":"06770544-d18e-461d-b56f-032e586d7a4a","resolution":{"observed_at":"2026-08-03T00:45:18.841065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.11417","last_updated":"2024-10-15T09:07:25Z","snapshot_observed_at":"2026-07-06T19:33:43.723135Z","submitted_at":"2024-10-15T09:07:25Z","title":"VidCompress: Memory-Enhanced Temporal Compression for Video Understanding in Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.11417","snapshot_observed_at":"2026-08-03T00:45:19.436099Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:19.436099Z"},"links":{"cited_paper":"/paper/2410.11417","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:2cbe45c4cf718c03c1575e5b85d05c136c40cb5c53d12019e021b22f6ac5d569","observation_id":"c580aa84-7a98-4e01-8779-fa12387451e9","resolution":{"observed_at":"2026-08-03T00:45:19.436099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:19.608202Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:19.608202Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:dba2cac8dda0ed93a2dd904a505d430551c9a6327df587708701c4cd07a5cf8b","observation_id":"440ecce3-6a1b-4c17-8a27-065f23ed68a5","resolution":{"observed_at":"2026-08-03T00:45:19.608202Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:19.269594Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:19.269594Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:e272f77d77e39678f385369827d8503517cfe3123440278f0a8e1fcd1e1b4535","observation_id":"799e79a8-80db-4ffb-aab1-6558d383001a","resolution":{"observed_at":"2026-08-03T00:45:19.269594Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:20.089474Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:20.089474Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:1fef999f8a3614a5651184d5b9a9d9d05a586a19a1b7f14c21a611fb1065d72b","observation_id":"e09d8e1d-99c0-4192-a2d5-128dd896d383","resolution":{"observed_at":"2026-08-03T00:45:20.089474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:20.198974Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:20.198974Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:446a8d9f159c0d8f785482cff80bafe78280793b2e02940226693a302001a003","observation_id":"eb28b3e3-5f5d-4661-9fb1-df39e5135787","resolution":{"observed_at":"2026-08-03T00:45:20.198974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:20.320864Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:20.320864Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:746822dcbb670ff2e709dee69d5cfa471f1a38c81ca1a2eca49a7bd8279eec89","observation_id":"54bb49ff-2275-4508-9f1b-c62c1e6b9bb5","resolution":{"observed_at":"2026-08-03T00:45:20.320864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:19.873867Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:19.873867Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:460889b20a336111f8809158c23eec932a43922392a9ddc374b08750117e2275","observation_id":"0743688d-f970-4d75-a14d-5746d6ff31a9","resolution":{"observed_at":"2026-08-03T00:45:19.873867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.15538","last_updated":"2024-02-23T06:25:20Z","snapshot_observed_at":"2026-08-07T06:06:05.718406Z","submitted_at":"2024-02-23T06:25:20Z","title":"AgentLite: A Lightweight Library for Building and Advancing Task-Oriented LLM Agent System","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.15538","snapshot_observed_at":"2026-08-03T00:45:20.580075Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:20.580075Z"},"links":{"cited_paper":"/paper/2402.15538","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:939fe698f6192cf3aa1f8b614d534eb12a7e8e72caf2cf5db2e1b1819451bcd8","observation_id":"ce72462f-034d-49eb-a5b4-d271ac466d16","resolution":{"observed_at":"2026-08-03T00:45:20.580075Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:20.680603Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:20.680603Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:32a5d59bb5e7b72e82d7bf49357fb9ff2635d99ffe6ee7098b5770eccba9d1ad","observation_id":"4fbd87b2-db79-4f0c-a390-fa1f641a7ad8","resolution":{"observed_at":"2026-08-03T00:45:20.680603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:20.723864Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:20.723864Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:81303f787be2590b9b96566842e6d3eea36784dce4bbb5a4bc8ddbb292f5f0cf","observation_id":"8bac47d6-b51d-4d62-87bd-72d9efa31d00","resolution":{"observed_at":"2026-08-03T00:45:20.723864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.18478","last_updated":"2025-04-27T10:39:51Z","snapshot_observed_at":"2026-08-07T16:41:53.661756Z","submitted_at":"2025-03-24T09:21:48Z","title":"Video-XL-Pro: Reconstructive Token Compression for Extremely Long Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.18478","snapshot_observed_at":"2026-08-03T00:45:20.463141Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:20.463141Z"},"links":{"cited_paper":"/paper/2503.18478","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:6c5939739c0bf67e575391b6afd9b56544150de2da05440af5fec4e36e72f68c","observation_id":"6a27851f-2519-4a71-a283-cdf7c5a5f0cd","resolution":{"observed_at":"2026-08-03T00:45:20.463141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.16971","last_updated":"2025-08-12T14:37:01Z","snapshot_observed_at":"2026-07-06T17:50:18.017647Z","submitted_at":"2024-03-25T17:32:23Z","title":"AIOS: LLM Agent Operating System","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.16971","snapshot_observed_at":"2026-08-03T00:45:20.977565Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:20.977565Z"},"links":{"cited_paper":"/paper/2403.16971","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:911db2648c1a47c3dfd26e32a2c7969c38645b850ec00bd5636db27a43322425","observation_id":"10c34dc4-6de5-4c93-b1dd-a3dbc03189b6","resolution":{"observed_at":"2026-08-03T00:45:20.977565Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.064539Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.064539Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:3b0d0aeadd684e0fca7bed2db1c22cb7a93d4e0dc45743dd4f856a68bff4b2c4","observation_id":"5f5497f5-c0f5-4dd2-a48a-9891c9b14187","resolution":{"observed_at":"2026-08-03T00:45:21.064539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17434","last_updated":"2024-10-22T21:21:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-22T21:21:37Z","title":"LongVU: Spatiotemporal Adaptive Compression for Long Video-Language Understanding","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.17434","snapshot_observed_at":"2026-08-03T00:45:21.181437Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.181437Z"},"links":{"cited_paper":"/paper/2410.17434","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:a91fcf60215339bc42afeaecc9a4806f869cf08c5e96136258af16ec924d81e9","observation_id":"5c7309b4-65d0-44a9-b2ad-a182d4451e0c","resolution":{"observed_at":"2026-08-03T00:45:21.181437Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:20.844210Z","title":null,"venue":null,"work_id":null,"year":1976},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:20.844210Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:3a2dcc144011610bfd199411e7c855a8c873fc66125ab72ab7a3cbf6506b124e","observation_id":"a34918f0-a3a7-4239-87ef-62587d3fe8cd","resolution":{"observed_at":"2026-08-03T00:45:20.844210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.381029Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.381029Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:ae27835f40b9757a87a838212e2eac2dfed70831111af5a9d8d6c2cef11d4070","observation_id":"79613a30-712e-4bd6-82eb-e6b0318a4ab4","resolution":{"observed_at":"2026-08-03T00:45:21.381029Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.436250Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.436250Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:0672afb805c002539163512217b4d5ed01f8a630d44f7cc0dc126c9ad20e84b5","observation_id":"fbc205e1-86c8-408e-817b-3e92fbe9a1d0","resolution":{"observed_at":"2026-08-03T00:45:21.436250Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.476187Z","title":null,"venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.476187Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:21cb459e68690eda500992fd86e5716d980d7ed6294f9ea40bd00534d0f44654","observation_id":"9858c82b-8c25-4e6d-8ad5-6ab1f6f286fb","resolution":{"observed_at":"2026-08-03T00:45:21.476187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.268601Z","title":"Singh, Adam Fry, Adam Perelman, Adam Tart, Adithya Ganesh, et al","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.268601Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:b2bb5d6e1462f3c525d17b2e2136e5f2cb0601bafc32cfa087fe028f08830f94","observation_id":"8f334793-c1f4-4d82-ab91-fa0cb40d8075","resolution":{"observed_at":"2026-08-03T00:45:21.268601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.03267","last_updated":"2026-05-01T23:55:43Z","snapshot_observed_at":"2026-08-02T10:52:10.211700Z","submitted_at":"2025-12-19T07:05:38Z","title":"OpenAI GPT-5 System Card","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.03267","snapshot_observed_at":"2026-08-03T00:45:21.321765Z","title":"arXiv preprint arXiv:2601.03267","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.321765Z"},"links":{"cited_paper":"/paper/2601.03267","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:1d2587c178bc6f420cb74faeb24c58667e61c72eae80f5f1df87f86e85313c74","observation_id":"f9bbe35a-de8f-4992-b614-5241ddd09df9","resolution":{"observed_at":"2026-08-03T00:45:21.321765Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.611234Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.611234Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:d7fa90e781abed13eccf31dee0d67b05ff133988f0cd78a955f145e23cd5206d","observation_id":"958dac49-23ea-47b8-8cc9-3617838c777a","resolution":{"observed_at":"2026-08-03T00:45:21.611234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.643270Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.643270Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:3a042c7db4745d647f32357c330d5ffb2cfd98ba9ebcdb54e466113b1ed394ef","observation_id":"7581626e-2593-46a4-ac04-1b679004cc46","resolution":{"observed_at":"2026-08-03T00:45:21.643270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.692483Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.692483Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:1f32129a9ae6776c317bb2791c620461497973e939dff4f5a6606dca6cf96395","observation_id":"e6500213-4e1e-4f84-b3ed-db60c70bc847","resolution":{"observed_at":"2026-08-03T00:45:21.692483Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.05269","last_updated":"2024-11-05T22:08:14Z","snapshot_observed_at":"2026-08-01T08:49:09.735566Z","submitted_at":"2023-12-07T19:19:25Z","title":"LifelongMemory: Leveraging LLMs for Answering Queries in Long-form Egocentric Videos","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.05269","snapshot_observed_at":"2026-08-03T00:45:21.530473Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.530473Z"},"links":{"cited_paper":"/paper/2312.05269","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:1caa5624d61aaad4e8a441b029ecab40ababb86832ef440fd2bd5b92ba0d99f2","observation_id":"a77eb260-ced3-4f34-8e49-fb651eda4273","resolution":{"observed_at":"2026-08-03T00:45:21.530473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.570118Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.570118Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:bf76224d75b27c1e700b70e11ef8eac0d208f74372cabf87acf24c10a64d38b3","observation_id":"6182cdd1-b915-44e7-85f6-c5ea67d179bd","resolution":{"observed_at":"2026-08-03T00:45:21.570118Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.00598","last_updated":"2022-05-27T17:52:50Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-04-01T17:43:13Z","title":"Socratic Models: Composing Zero-Shot Multimodal Reasoning with Language","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.00598","snapshot_observed_at":"2026-08-03T00:45:21.858665Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.858665Z"},"links":{"cited_paper":"/paper/2204.00598","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:2c527983920a3f899469ccc0b2c00e82669c9ce892245be4dd052db55e4dbdc3","observation_id":"0a8575e8-5143-4b1e-b09a-9a59acd678ad","resolution":{"observed_at":"2026-08-03T00:45:21.858665Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.08085","last_updated":"2024-06-30T05:39:46Z","snapshot_observed_at":"2026-08-03T12:09:02.990658Z","submitted_at":"2024-06-12T11:07:55Z","title":"Flash-VStream: Memory-Based Real-Time Understanding for Long Video Streams","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.08085","snapshot_observed_at":"2026-08-03T00:45:21.931265Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.931265Z"},"links":{"cited_paper":"/paper/2406.08085","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:a8e5797155458344cdb136679da4a3a185c90f84520d7af9af6c62d1ea786309","observation_id":"9cea1237-dc36-4c46-8a46-6741e1a482ff","resolution":{"observed_at":"2026-08-03T00:45:21.931265Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:22.048780Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:22.048780Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:aaee02e4090782f49582af5ca2d537318da6ce4343edb9e5fe287868cfc5cce4","observation_id":"0cd472b3-5519-40a6-b35c-3ceafe517761","resolution":{"observed_at":"2026-08-03T00:45:22.048780Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.715438Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.715438Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:1d4c6a00afc4fdfa64ef8d76d7247c87136b873d7e46d3fca54a29b156f45707","observation_id":"58d842e1-2cfc-4edc-958a-8d46b899664f","resolution":{"observed_at":"2026-08-03T00:45:21.715438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-08-03T00:45:21.747866Z","title":"https://arxiv.org/abs/2509.17765","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.747866Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:5d7f7bba180715e07bd05285e4659c1f4329369b84aa08b63b819c58675becbe","observation_id":"2285b190-56e8-41f5-9b50-1c5626af25e4","resolution":{"observed_at":"2026-08-03T00:45:21.747866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:21.788626Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.788626Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:821047604143221114dc89adb5091e3cd462b6209151998d34bf8a2772fc6819","observation_id":"fd057e2b-238b-4d89-a0a8-e4be96928771","resolution":{"observed_at":"2026-08-03T00:45:21.788626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12110","last_updated":"2025-10-08T01:46:37Z","snapshot_observed_at":"2026-08-03T02:27:06.991396Z","submitted_at":"2025-02-17T18:36:14Z","title":"A-MEM: Agentic Memory for LLM Agents","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12110","snapshot_observed_at":"2026-08-03T00:45:21.820876Z","title":"https://arxiv.org/abs/2502.12110","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:21.820876Z"},"links":{"cited_paper":"/paper/2502.12110","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:589977038172edb14ac0bcb9b0bc236f3a2220c2e4c2a7b84eee6021705bc5b0","observation_id":"de225c27-9aa5-43fd-8a53-c945f5a12753","resolution":{"observed_at":"2026-08-03T00:45:21.820876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T00:45:19.774729Z","title":"9459– 9474 pages","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:19.774729Z"},"links":{"citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:9b1ff4d03395650c4cf2f8cffbb529de6e2fb7218ee07c34b705e4f0211ee964","observation_id":"9d9a928f-598f-49e8-848e-289b8cfd0bd8","resolution":{"observed_at":"2026-08-03T00:45:19.774729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-03T00:45:19.098645Z","title":"https://arxiv.org/abs/2410.21276","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:19.098645Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:1ed37dbd7f43b6fce02a043782a502292f02b636bd0f41fc845946027c9a6e89","observation_id":"4817d789-99a7-49f3-851b-9a432cdb0407","resolution":{"observed_at":"2026-08-03T00:45:19.098645Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.19413","last_updated":"2025-04-28T01:46:35Z","snapshot_observed_at":"2026-08-02T07:32:11.339534Z","submitted_at":"2025-04-28T01:46:35Z","title":"Mem0: Building Production-Ready AI Agents with Scalable Long-Term Memory","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.19413","snapshot_observed_at":"2026-08-03T00:45:17.869294Z","title":"https://arxiv.org/abs/2504.19413","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-03T00:45:17.869294Z"},"links":{"cited_paper":"/paper/2504.19413","citing_paper":"/paper/2607.28678"},"observation_digest":"sha256:320af357523ef1c63183bb65f934d730a5938d694914bf2f5af5867de01ed57f","observation_id":"21692a9c-afe7-46ee-97f2-6b3299d04588","resolution":{"observed_at":"2026-08-03T00:45:17.869294Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28678","last_updated":"2026-07-29T10:25:23Z","latest_version":1,"primary_category":"cs.AI","snapshot_observed_at":"2026-08-07T03:57:17.672794Z","submitted_at":"2026-07-29T10:25:23Z","title":"ViSAGE: Constructing Self-Correcting Memories for Long-Form Video Understanding"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2607.28678."}