{"as_of":"2026-08-04T17:00:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:15b1269a761c35d90d4caec2b953b745ba5b207b7e50140d2c055733a8beedcb","coverage":[{"denominator":20,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":20,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-21T05:56:24.066641Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-28T18:56:02.705502Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-06-28T19:02:34.472197Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"cited_work":{"arxiv_id":"2605.20901","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20901","snapshot_observed_at":"2026-06-28T19:02:34.472197Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","venue":"cs.CV","work_id":"41030b99-c085-4a54-add3-d02b130314b6","year":2026},"citing_paper":{"arxiv_id":"2606.00662","last_updated":"2026-05-30T10:23:12Z","snapshot_observed_at":"2026-08-02T23:56:45.505298Z","submitted_at":"2026-05-30T10:23:12Z","title":"TAP-JEPA: Frozen Future-Latent Probing and Two-Stage Score Fusion for EPIC-KITCHENS-100 Action Anticipation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T18:56:02.705502Z"},"links":{"cited_paper":"/paper/2605.20901","citing_paper":"/paper/2606.00662"},"observation_digest":"sha256:4e7d9b554c881d8da1b14ca07e27086335e8ddb1c0a8cf61ac83ac6185ece96c","observation_id":"ea327775-67fc-4090-9a6d-55c90a1e3cb8","resolution":{"observed_at":"2026-06-28T19:02:34.473485Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"cited_work":{"arxiv_id":"2605.20901","doi":null,"metadata_source":"pith","pith_arxiv_id":"2605.20901","snapshot_observed_at":"2026-06-28T19:02:34.472197Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","venue":"cs.CV","work_id":"41030b99-c085-4a54-add3-d02b130314b6","year":2026},"citing_paper":{"arxiv_id":"2606.00694","last_updated":"2026-05-30T12:07:32Z","snapshot_observed_at":"2026-07-06T23:41:19.955034Z","submitted_at":"2026-05-30T12:07:32Z","title":"FROST-STA: Frozen Dense Features for the Ego4D Short-Term Object Interaction Anticipation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T18:40:14.973329Z"},"links":{"cited_paper":"/paper/2605.20901","citing_paper":"/paper/2606.00694"},"observation_digest":"sha256:29d0c7418994ed336c8092c48ca1e773dd0944eb3e4fefa9b6e1757768189748","observation_id":"2b644386-ccad-4787-927e-62cbf866c9c9","resolution":{"observed_at":"2026-06-28T18:42:29.461244Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2605.20901/citation-record","integrity":"/paper/2605.20901/integrity","json":"/paper/2605.20901/citation-record.json","paper":"/paper/2605.20901"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.02550","last_updated":"2025-06-11T11:16:41Z","snapshot_observed_at":"2026-08-04T00:53:33.816133Z","submitted_at":"2025-06-03T07:36:52Z","title":"Technical Report for Ego4D Long-Term Action Anticipation Challenge 2025","version":2},"cited_work":{"arxiv_id":"2506.02550","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.02550","snapshot_observed_at":"2026-06-28T19:02:34.474646Z","title":"Technical report for Ego4D long-term action anticipation challenge 2025","venue":null,"work_id":"03b63377-305b-41cb-9636-9099bb9b71f2","year":2025},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"cited_paper":"/paper/2506.02550","citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:9a9528796109c853b8b47ff72941c29142bdb57b96c7d29735ef3b87a25389e2","observation_id":"a84535a6-3e0e-4bfe-8622-0011883967e1","resolution":{"observed_at":"2026-05-21T05:59:40.973654Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Intention-guided cognitive reason- ing for egocentric long-term action anticipation","venue":null,"work_id":"f91b7464-e394-4e6b-8ac8-dbc5444cafc6","year":2026},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:42dd4cbdce4f9b85d81dd744ecc6e6eea30792ab97ea68e2b7f73055929668fb","observation_id":"34183a3c-e06a-40de-a338-653b6ded1bf7","resolution":{"observed_at":"2026-05-21T05:59:41.825684Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"SlowFast networks for video recognition","venue":null,"work_id":"0047884c-2304-4867-b616-014da6f35aba","year":2019},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:52571742936f32dfc0db5a76c2cddb23cad705c886beb28889d2ea8e4fb86a0e","observation_id":"80ea0dcb-da74-4343-aaa2-8a002e95f906","resolution":{"observed_at":"2026-05-21T05:59:41.827626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03710","last_updated":"2025-06-04T08:41:42Z","snapshot_observed_at":"2026-07-06T21:36:20.767684Z","submitted_at":"2025-06-04T08:41:42Z","title":"OSGNet @ Ego4D Episodic Memory Challenge 2025","version":1},"cited_work":{"arxiv_id":"2506.03710","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03710","snapshot_observed_at":"2026-06-29T00:22:51.943251Z","title":"OSGNet @ Ego4D episodic memory challenge 2025","venue":null,"work_id":"0871ff54-c981-475b-b915-a4f7e5d4248d","year":2025},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"cited_paper":"/paper/2506.03710","citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:b3374529a818016615cca4ed15e056f384bd331f9816b5979e7e0dc96c0d5f9e","observation_id":"41f8c3f4-d87d-4ff7-8e78-02643c203e5c","resolution":{"observed_at":"2026-05-21T05:59:40.966646Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Ego4D: Around the world in 3,000 hours of egocentric video","venue":null,"work_id":"0e4264b1-235a-4b04-bad9-45df22d8d9a6","year":2022},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:fee51ef66d2cd2eb369df33234d2241f11126e7beee2d17f3932a347333f1aa4","observation_id":"08483098-64a8-443c-a957-89c801534fd0","resolution":{"observed_at":"2026-05-21T05:59:41.851415Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Deep residual learning for image recognition","venue":null,"work_id":"66cff26d-59d0-49f1-86da-e493405c0a26","year":2016},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:15d071a024a98279d45dab64a7e063906070ffde16324bbb5afcbc6fce02c2cf","observation_id":"e1c7f140-10dd-4ee4-8042-c93c67a08788","resolution":{"observed_at":"2026-05-21T05:59:41.823679Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Mask R-CNN","venue":null,"work_id":"6eef4d7c-ecb8-4fcd-a1e2-1abadd71f1b7","year":null},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:b5a1634148a9f79f54cc39ce6075d93a2b0a5bb1a0902a20ad80bf2329b9d2bc","observation_id":"df03b864-cf0f-4171-9891-187f5ee35c76","resolution":{"observed_at":"2026-05-21T05:59:41.829567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Lawrence Zitnick","venue":null,"work_id":"f30d20e5-d585-4ce5-9c61-cf1792d1c1bd","year":2014},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:9102f100135ffd213e0c3a6b1173f46667631102393cd4ba7e8bbf07a9767a14","observation_id":"c4787762-a3c9-47ce-be3b-8f9d01fa6e33","resolution":{"observed_at":"2026-05-21T05:59:41.831744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Feature pyramid networks for object detection","venue":null,"work_id":"8b4e5dc3-3140-4634-a8d2-2df21407ec30","year":2017},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:abb1c029e943d8ae95f82cac63333056644eddc6287451ce51d8c6bd1fb6d68f","observation_id":"4bcc3aa2-29a7-4ec9-aad8-9ad214b3247a","resolution":{"observed_at":"2026-05-21T05:59:41.833560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2603.14482","last_updated":"2026-06-11T10:07:56Z","snapshot_observed_at":"2026-08-04T07:59:53.677916Z","submitted_at":"2026-03-15T17:02:40Z","title":"V-JEPA 2.1: Unlocking Dense Features in Video Self-Supervised Learning","version":3},"cited_work":{"arxiv_id":"2603.14482","doi":"10.48550/arxiv.2603.14482","metadata_source":"pith","pith_arxiv_id":"2603.14482","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"V-JEPA 2.1: Unlocking dense features in video self-supervised learning","venue":"cs.CV","work_id":"3da7cd7a-c3f3-4e48-9704-4320e54aec60","year":2026},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"cited_paper":"/paper/2603.14482","citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:bc9871fffbf3ac92d5be866a343e10c6e5c113d306f1f306606ffca49f5add1a","observation_id":"7fe5a460-5b4b-4643-b308-348950b14f0e","resolution":{"observed_at":"2026-06-12T02:09:17.107412Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"FiLM: Visual reasoning with a general conditioning layer","venue":null,"work_id":"4be03b4f-8ad1-415a-8363-2726cba79225","year":2018},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:608ed5ffb356a89adfc843b68065028268c370f58cd018954f4227597849b74e","observation_id":"84bc4bed-8f87-4b2b-8fb5-a8ccbc64f344","resolution":{"observed_at":"2026-05-21T05:59:41.853146Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"StillFast: An end-to-end approach for short- term object interaction anticipation","venue":null,"work_id":"b7631028-e783-4e52-85e8-af4e336ca882","year":2023},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:bfc8840c61e8efca8b618717b5a472150c1f9cece1028fbf9ec84bfb6adaf6b1","observation_id":"7a46d654-e0f7-499b-bf1f-f4eea7550315","resolution":{"observed_at":"2026-05-21T05:59:41.847706Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Faster R-CNN: Towards real-time object detection with re- gion proposal networks","venue":null,"work_id":"3c155ab0-317d-478b-8610-a4451b07984b","year":2015},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:926f8b69e72c9b4c2f757fa3404cb114aebc0b52ee490de5885078e098a110ed","observation_id":"dd6fee71-3e7b-4985-85fe-767bc18b85c6","resolution":{"observed_at":"2026-05-21T05:59:41.849699Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multimodal dialog system: Rela- tional graph-based context-aware question understanding","venue":null,"work_id":"079434d8-b90a-4881-a6ff-4e229e4882d8","year":2021},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:d0966ee769b4c07adc565bf683855da37092bd94fc9b8f61e1f834a3e8f75a97","observation_id":"143b91ea-d523-46d7-b75e-1d199089b014","resolution":{"observed_at":"2026-05-21T05:59:41.843550Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Attribute-guided collab- orative learning for partial person re-identification.IEEE Transactions on Pattern Analysis and Machine Intelligence, 45(12):14144–14160","venue":null,"work_id":"76b70128-ff9c-4b38-9362-4badab314550","year":2023},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:b9b825791f8c5e4ec28b816d67702a1ffb8bfde84566882aeb45b20cd222de94","observation_id":"70226f24-d213-4599-8d4f-390548afd28f","resolution":{"observed_at":"2026-05-21T05:59:41.845837Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-factor adaptive vision selec- tion for egocentric video question answering","venue":null,"work_id":"04d3ecb8-98d1-416a-9cce-7f685ac9e211","year":2024},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:5874d0fa49e7c23777f37ebf1f726972489d9a1b27a8eb551cb1d021578b5f68","observation_id":"31c35ed3-3abe-4428-a3dd-8df5429d6e8c","resolution":{"observed_at":"2026-05-21T05:59:41.839601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Multi-factor adaptive vision selec- tion for egocentric video question answering","venue":null,"work_id":"00bb18ca-780d-4b08-b94b-655b12642eb5","year":2024},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:536ba5f52ca9d022f65032104e79226b9e68d8cba660332a08e8acfadc46f496","observation_id":"ecd84d7f-ccbe-41aa-82e0-97d54f780360","resolution":{"observed_at":"2026-05-21T05:59:41.841431Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.20644","last_updated":"2025-05-27T02:45:14Z","snapshot_observed_at":"2026-07-06T21:31:02.262018Z","submitted_at":"2025-05-27T02:45:14Z","title":"HCQA-1.5 @ Ego4D EgoSchema Challenge 2025","version":1},"cited_work":{"arxiv_id":"2505.20644","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2505.20644","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"HCQA-1.5 @ Ego4D EgoSchema challenge 2025","venue":null,"work_id":"e7df1b39-225e-44cb-9a52-9c12055188cb","year":2025},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"cited_paper":"/paper/2505.20644","citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:0869c5079d488814003674f0e114aad5028af1ea0f6b183f5a135647a1a7bd3a","observation_id":"0fbd7d62-d046-4937-83d5-efe6ca1246ca","resolution":{"observed_at":"2026-05-21T05:59:40.970085Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Spatial understanding from videos: Structured prompts meet simulation data","venue":null,"work_id":"a0b91e73-cdd2-49df-88f9-bdd3163984fd","year":2025},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:53b737ea5ab17bb1ef473022ec69c6b82921daf87a434ff252f51603c2646748","observation_id":"914768b3-706f-4d80-99b1-efae90680890","resolution":{"observed_at":"2026-05-21T05:59:41.837745Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Exo2Ego: Exocentric knowledge guided MLLM for egocentric video understand- ing","venue":null,"work_id":"6c2825fd-6b86-4b59-9aaa-a1b6e97154ee","year":2026},"citing_paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-21T05:56:24.066641Z"},"links":{"citing_paper":"/paper/2605.20901"},"observation_digest":"sha256:395be80252f793df079894f0040ed2fdb356112af1bc603522df84b0c05d71fe","observation_id":"98322fdc-2752-4d5e-b622-24f192249c5b","resolution":{"observed_at":"2026-05-21T05:59:41.835784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.20901","last_updated":"2026-05-20T08:42:56Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T23:31:27.989406Z","submitted_at":"2026-05-20T08:42:56Z","title":"VISTA: Technical Report for the Ego4D Short-Term Object Interaction Anticipation at EgoVis 2026"},"reference_resolution":{"displayed":20,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":4,"verified_fuzzy":16},"total_outbound_references":20},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 4 August 2026, this Paper Citation Record lists 20 of 20 outbound references and 2 inbound Pith citation observations for arXiv:2605.20901."}