{"as_of":"2026-08-12T14:48:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0b9ad3f6685320782b532e66ae57d7d6cfe740a523ee6d4552b0c5f01ae80b21","coverage":[{"denominator":220,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-11T03:13:44.414237Z","state":"measured"},{"denominator":200,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":200,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":327,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":100,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-12T14:04:12.469947Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-09T11:16:11.423695Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"1906.11415","last_updated":"2019-06-27T03:04:16Z","snapshot_observed_at":"2026-08-07T03:24:40.978756Z","submitted_at":"2019-06-27T03:04:16Z","title":"Few-Shot Video Classification via Temporal Alignment","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-25T15:16:42.798769Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1906.11415"},"observation_digest":"sha256:5bfd6dd5c8477e6c02f9eb8ba7d8e719421764b935233e4046ce5e621e32ffb7","observation_id":"ac10f374-8986-4f6a-945b-17a81a775123","resolution":{"observed_at":"2026-05-25T15:17:01.839722Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"1907.04632","last_updated":"2019-07-10T11:44:28Z","snapshot_observed_at":"2026-07-06T08:06:46.800927Z","submitted_at":"2019-07-10T11:44:28Z","title":"Video Action Recognition Via Neural Architecture Searching","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-24T23:58:53.094920Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1907.04632"},"observation_digest":"sha256:b71ed72418af9c5a44d4ff51ac4ed7c70b0ed7d58bccf8de972555fad46d1603","observation_id":"8bf7475c-292c-4d06-bdad-595ff06f20ce","resolution":{"observed_at":"2026-05-25T00:00:08.209608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"1907.05006","last_updated":"2019-07-11T05:51:39Z","snapshot_observed_at":"2026-08-09T12:10:25.461628Z","submitted_at":"2019-07-11T05:51:39Z","title":"Two-stream Spatiotemporal Feature for Video QA Task","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-24T23:29:16.884049Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1907.05006"},"observation_digest":"sha256:163efad5d150a012b151e8f79bde564b427020c2e7cb295934edbc43d529a766","observation_id":"d0a7466f-1e06-47fc-abbb-8d341a61051d","resolution":{"observed_at":"2026-05-24T23:30:03.878843Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"1907.05640","last_updated":"2019-07-12T09:23:32Z","snapshot_observed_at":"2026-08-02T02:50:58.074764Z","submitted_at":"2019-07-12T09:23:32Z","title":"AVD: Adversarial Video Distillation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-24T22:41:10.342189Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1907.05640"},"observation_digest":"sha256:2463769e61be086990630bc32d3ed938eee43fb8b6f522d15a2052c983b56f28","observation_id":"7e925563-924d-443f-b0a1-d93198cad2b2","resolution":{"observed_at":"2026-05-24T22:45:02.682559Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"1907.08895","last_updated":"2019-07-21T02:05:38Z","snapshot_observed_at":"2026-08-12T00:02:16.110524Z","submitted_at":"2019-07-21T02:05:38Z","title":"An Efficient 3D CNN for Action/Object Segmentation in Video","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-24T18:59:16.594796Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1907.08895"},"observation_digest":"sha256:51b4752b2096ffbc0bb1030254e36cd67eddf675980848507dc4b2d20c78471d","observation_id":"c656765c-0cf8-46e7-8d96-b53985c11e8e","resolution":{"observed_at":"2026-05-24T18:59:49.439028Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"1907.09021","last_updated":"2019-07-21T19:52:24Z","snapshot_observed_at":"2026-08-04T11:34:55.154439Z","submitted_at":"2019-07-21T19:52:24Z","title":"TARN: Temporal Attentive Relation Network for Few-Shot and Zero-Shot Action Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T18:29:01.126742Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1907.09021"},"observation_digest":"sha256:f2d33b24edf2305c0d448569b8b695070054bde8c85eb7f7a3a5ccf50d0e9084","observation_id":"469c1e28-0996-495e-a493-3c319c00f6ea","resolution":{"observed_at":"2026-05-24T18:29:47.981882Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"1907.10473","last_updated":"2019-07-22T17:50:31Z","snapshot_observed_at":"2026-07-06T08:09:54.115258Z","submitted_at":"2019-07-22T17:50:31Z","title":"Switchable Normalization for Learning-to-Normalize Deep Representation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-24T18:04:55.224875Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1907.10473"},"observation_digest":"sha256:0298359774ee29cc8cf956941156d706d9b7348622e62510dc1e398d488ef20a","observation_id":"6e3f004c-a738-415c-9059-aeea35593502","resolution":{"observed_at":"2026-05-24T18:06:18.524256Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"1907.10837","last_updated":"2019-07-25T04:48:10Z","snapshot_observed_at":"2026-08-04T00:25:40.912707Z","submitted_at":"2019-07-25T04:48:10Z","title":"Submission to ActivityNet Challenge 2019: Task B Spatio-temporal Action Localization","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-24T16:41:45.257171Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1907.10837"},"observation_digest":"sha256:cd7d86480e602cae85e5bc7463e4cd88f7ca1bb9135ea5b63a6f7174b44b7464","observation_id":"845c8ad9-d157-416d-b17d-96e60b39316e","resolution":{"observed_at":"2026-05-24T16:44:41.800706Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-07-06T12:57:51.108636Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-13T14:38:27.919104Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2204.03458"},"observation_digest":"sha256:c186b8006c263d59c73a8af1123a618f8acd187af658d6bc819b1669f71913b1","observation_id":"9cde2c97-577a-4416-9069-403f48e70a6d","resolution":{"observed_at":"2026-05-13T14:38:27.994384Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2205.01917","last_updated":"2022-06-14T00:48:04Z","snapshot_observed_at":"2026-08-10T15:05:25.558818Z","submitted_at":"2022-05-04T07:01:14Z","title":"CoCa: Contrastive Captioners are Image-Text Foundation Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-15T10:53:08.292063Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2205.01917"},"observation_digest":"sha256:c3858e05fcf71896af14406b2a82bb2913fdcdadadddeec5500dae7e6a888d1f","observation_id":"ab19c183-fbb7-4a89-ba32-af0dc7fb48c5","resolution":{"observed_at":"2026-05-15T10:53:08.475297Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2210.09461","last_updated":"2023-03-01T19:45:11Z","snapshot_observed_at":"2026-07-06T14:06:56.291161Z","submitted_at":"2022-10-17T22:23:40Z","title":"Token Merging: Your ViT But Faster","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-12T20:52:10.065925Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2210.09461"},"observation_digest":"sha256:ce5dd216c26c52fffbf1f448864b0db56d62e57d924237cdd9b511e48db3190e","observation_id":"9acd442a-4371-46f5-801c-b530d15679c0","resolution":{"observed_at":"2026-05-12T20:52:10.466868Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-11T10:12:11.384939Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-09T04:17:19.878360Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2304.07193"},"observation_digest":"sha256:f5b816fcd6f3e3722d8d99d3cc54e369179de6e58d9f4f1b0c3fd7f8d82c1029","observation_id":"1d52adaa-7998-4af3-a14b-c171b5807a2e","resolution":{"observed_at":"2026-05-11T03:13:45.682066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2309.16588","last_updated":"2024-04-12T09:38:33Z","snapshot_observed_at":"2026-08-07T09:40:32.614733Z","submitted_at":"2023-09-28T16:45:46Z","title":"Vision Transformers Need Registers","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-05-13T09:41:37.937046Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2309.16588"},"observation_digest":"sha256:cf0c129ddec2bf4391a6d7d55ff0413b16e21f3a6d79150cd22ca3444590d598","observation_id":"4c190a17-5180-416f-9922-7a041c05554f","resolution":{"observed_at":"2026-05-13T09:41:38.093477Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2310.01852","last_updated":"2024-01-22T03:11:15Z","snapshot_observed_at":"2026-08-07T05:10:33.059352Z","submitted_at":"2023-10-03T07:33:27Z","title":"LanguageBind: Extending Video-Language Pretraining to N-modality by Language-based Semantic Alignment","version":7},"reference_index":216,"source":"arxiv_source","source_observed_at":"2026-05-17T03:27:58.952076Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2310.01852"},"observation_digest":"sha256:0740cf59413bec333de292a88948d722a0a5baad70a70b023ac1dd95c1ce96fd","observation_id":"73794b47-7749-4241-8346-4beddfb8c663","resolution":{"observed_at":"2026-05-17T03:27:59.166465Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2310.05737","last_updated":"2024-03-29T17:44:41Z","snapshot_observed_at":"2026-08-02T18:23:02.746177Z","submitted_at":"2023-10-09T14:10:29Z","title":"Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation","version":3},"reference_index":296,"source":"arxiv_source","source_observed_at":"2026-05-13T20:06:44.480769Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2310.05737"},"observation_digest":"sha256:86ffa854c82fb970243f07383c52e553eb3f44b2bb33ce924976f1bc11c684ee","observation_id":"80fb7ee4-7ed5-40b9-951d-c563b03a85ba","resolution":{"observed_at":"2026-05-13T20:06:44.723922Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2311.17005","last_updated":"2024-05-23T14:49:29Z","snapshot_observed_at":"2026-07-06T16:53:55.269172Z","submitted_at":"2023-11-28T17:59:04Z","title":"MVBench: A Comprehensive Multi-modal Video Understanding Benchmark","version":4},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-17T20:22:34.954228Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2311.17005"},"observation_digest":"sha256:35ca276260b6ef006905c5f0fc7a112f3b6ce0ff10962eb315f8bf539471e9b2","observation_id":"c6867e38-db18-4f71-8bd6-8a4ee3a4dd8f","resolution":{"observed_at":"2026-05-17T20:22:35.131390Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2312.02549","last_updated":"2026-05-12T03:27:06Z","snapshot_observed_at":"2026-07-06T16:57:01.638187Z","submitted_at":"2023-12-05T07:37:21Z","title":"DemaFormer: Damped Exponential Moving Average Transformer with Energy-Based Modeling for Temporal Language Grounding","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-05-24T04:51:07.439654Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2312.02549"},"observation_digest":"sha256:3a58f11795717a6066f3060dd8a0ff56f752c0bd035c60d10681d0a90db67e12","observation_id":"e268f06b-b673-4dd9-9d2d-a9e17a91471e","resolution":{"observed_at":"2026-05-24T04:53:54.027418Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2401.03717","last_updated":"2026-05-16T18:59:42Z","snapshot_observed_at":"2026-08-02T21:39:50.574099Z","submitted_at":"2024-01-08T08:00:04Z","title":"Universal Time-Series Representation Learning: A Survey","version":4},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-24T04:26:45.527625Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2401.03717"},"observation_digest":"sha256:99520a71fccaa173adc56f5b1c94222e5308021e9d6a8917478d550dcd4a6c91","observation_id":"7d1e326f-9574-4d42-88ff-ada199ade117","resolution":{"observed_at":"2026-05-24T04:28:53.446933Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2401.07669","last_updated":"2026-05-25T19:17:10Z","snapshot_observed_at":"2026-08-01T15:10:33.776201Z","submitted_at":"2024-01-15T13:27:34Z","title":"SRL-CLIP: Efficient CLIP Video Adaptation via Structured Semantic Role Labels","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-24T04:46:18.542521Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2401.07669"},"observation_digest":"sha256:6425c12d36d749e91187a337b3d4f114522a0c208fceceb84c0b725436188ef6","observation_id":"72bb932d-c5e3-437f-afb5-c977516cb393","resolution":{"observed_at":"2026-05-24T04:48:54.271863Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2403.14608","last_updated":"2024-09-16T02:54:50Z","snapshot_observed_at":"2026-08-04T09:07:42.158421Z","submitted_at":"2024-03-21T17:55:50Z","title":"Parameter-Efficient Fine-Tuning for Large Models: A Comprehensive Survey","version":7},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-13T11:32:36.738536Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2403.14608"},"observation_digest":"sha256:62d82060fc6bfe0991c3f660d27cb83a42d0ea18c31b9ea02324979525a7e605","observation_id":"00b53d07-62ee-4675-a6ad-c33985fe6a6f","resolution":{"observed_at":"2026-05-13T11:32:36.990608Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2404.08471","last_updated":"2024-02-15T18:59:11Z","snapshot_observed_at":"2026-08-07T02:30:11.447693Z","submitted_at":"2024-02-15T18:59:11Z","title":"Revisiting Feature Prediction for Learning Visual Representations from Video","version":1},"reference_index":252,"source":"arxiv_source","source_observed_at":"2026-05-12T12:40:23.709098Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2404.08471"},"observation_digest":"sha256:f851b862900a723f3ab22d2f231781f3da188423db6771f7d0fa8e928c8121a9","observation_id":"aed99000-0510-4592-8a78-5ae7c3b30395","resolution":{"observed_at":"2026-05-12T12:40:23.941476Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2404.16994","last_updated":"2024-04-29T14:52:02Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-04-25T19:29:55Z","title":"PLLaVA : Parameter-free LLaVA Extension from Images to Videos for Video Dense Captioning","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-15T20:21:57.873354Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2404.16994"},"observation_digest":"sha256:abf2efe3f5815bbd0ec62b7a4f1fc37cb927782358da72182870053a881ac383","observation_id":"421e866c-4eff-49c4-af60-5f7a37aa6b4f","resolution":{"observed_at":"2026-05-15T20:21:57.950696Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2406.04264","last_updated":"2025-01-01T15:53:58Z","snapshot_observed_at":"2026-08-03T20:38:36.602554Z","submitted_at":"2024-06-06T17:09:32Z","title":"MLVU: Benchmarking Multi-task Long Video Understanding","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-14T19:55:26.333923Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2406.04264"},"observation_digest":"sha256:4c3d8126c8112497c5aa2e4e8a5d247742da17bef60ed21c8a70e25d760303d0","observation_id":"9ab836f8-18d3-46a3-bcd1-b75c2b680dd5","resolution":{"observed_at":"2026-05-14T19:55:26.561377Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2406.07476","last_updated":"2024-10-30T06:49:54Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-06-11T17:22:23Z","title":"VideoLLaMA 2: Advancing Spatial-Temporal Modeling and Audio Understanding in Video-LLMs","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T02:44:53.284345Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2406.07476"},"observation_digest":"sha256:af985af9047e87e02ff587d5b20f6475713222d2ab3cf3b6adf8ccc631508392","observation_id":"c413a15a-7980-4913-a1e7-293c8002ca0d","resolution":{"observed_at":"2026-05-11T03:13:45.682066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2409.17596","last_updated":"2026-05-06T00:45:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-26T07:22:38Z","title":"Subjective and Objective Quality-of-Experience Evaluation Study for Live Video Streaming","version":3},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-23T21:09:06.644157Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2409.17596"},"observation_digest":"sha256:c8f46cf85dbd0d45fefd970517a5da55d73401c36193365019b3b24fa1f62b9e","observation_id":"e4e8c9b3-6e63-42e3-a142-cdf6b7bab2fe","resolution":{"observed_at":"2026-05-23T21:13:27.919622Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2410.02713","last_updated":"2025-08-01T16:40:14Z","snapshot_observed_at":"2026-08-02T12:24:31.329178Z","submitted_at":"2024-10-03T17:36:49Z","title":"LLaVA-Video: Video Instruction Tuning With Synthetic Data","version":3},"reference_index":143,"source":"arxiv_source","source_observed_at":"2026-05-10T23:20:32.330351Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2410.02713"},"observation_digest":"sha256:9df2e030f6306daddd67610dfcacb445210204e604655b1282df300e8a04352f","observation_id":"bb999c37-8cdd-4dd4-a992-061baf00d1d2","resolution":{"observed_at":"2026-05-11T03:13:45.682066Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2410.05363","last_updated":"2024-10-07T17:56:04Z","snapshot_observed_at":"2026-08-08T09:48:34.424815Z","submitted_at":"2024-10-07T17:56:04Z","title":"Towards World Simulator: Crafting Physical Commonsense-Based Benchmark for Video Generation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-05-18T14:39:59.870039Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2410.05363"},"observation_digest":"sha256:41592d8f5c7a55a6d17028fa0e0833b9f287d2fb69b938b0ce0cd57970f4590b","observation_id":"ef9fce4a-877d-4e5c-bd1d-bb1e8775e392","resolution":{"observed_at":"2026-05-18T14:40:00.134838Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2410.17434","last_updated":"2024-10-22T21:21:37Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-22T21:21:37Z","title":"LongVU: Spatiotemporal Adaptive Compression for Long Video-Language Understanding","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-16T13:53:33.585035Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2410.17434"},"observation_digest":"sha256:775a7469649442682b37fcce161a82f6eaac5c4fa09d6ff4fce5dd5e4abc817d","observation_id":"1ac7dc2b-096d-4acb-b75d-fea996090646","resolution":{"observed_at":"2026-05-16T13:53:33.662347Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2410.18717","last_updated":"2026-05-04T11:21:05Z","snapshot_observed_at":"2026-08-06T03:30:40.083854Z","submitted_at":"2024-10-24T13:22:33Z","title":"Low-Latency Video Anonymization for Crowd Anomaly Detection: Privacy Versus Performance","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-23T18:25:44.799112Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2410.18717"},"observation_digest":"sha256:6491ad085255d1133eb497f78d13ff70b2dd2996a82e0e4e00447bc89e8ca505","observation_id":"11930015-fde7-45a7-80e8-3086098f4a7f","resolution":{"observed_at":"2026-05-23T18:28:18.993877Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2411.02327","last_updated":"2026-05-01T17:44:24Z","snapshot_observed_at":"2026-07-06T19:45:00.034364Z","submitted_at":"2024-11-04T17:50:36Z","title":"PPLLaVA: Varied Video Sequence Understanding With Prompt Guidance","version":4},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-23T17:31:59.030963Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2411.02327"},"observation_digest":"sha256:244cd6a1a87c4408c749353158bbc62490be1ae21cd2271067eab3debccd1e30","observation_id":"c674f23e-cc95-4b6d-aa9d-0f395eaddf1e","resolution":{"observed_at":"2026-05-23T17:33:15.660977Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-12T14:04:12.469947Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.15729","last_updated":"2025-06-09T08:55:43Z","snapshot_observed_at":"2026-08-12T13:56:16.647744Z","submitted_at":"2024-11-24T06:10:05Z","title":"OccludeNet: A Causal Journey into Mixed-View Actor-Centric Video Action Recognition under Occlusions","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-12T14:04:12.469947Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2411.15729"},"observation_digest":"sha256:70fef836bdda00c7ad9cc567c39073a077322c4ffb4e7876d951a89229f9016b","observation_id":"4513721f-6e57-4fac-8fe6-b631b605539c","resolution":{"observed_at":"2026-08-12T14:04:12.469947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-12T12:04:12.942661Z","title":"In: arXiv preprint arXiv:1705.06950 (2017) 2, 8, 13, 16","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2411.17584","last_updated":"2024-11-26T16:51:11Z","snapshot_observed_at":"2026-08-12T11:55:05.874154Z","submitted_at":"2024-11-26T16:51:11Z","title":"Pre-training for Action Recognition with Automatically Generated Fractal Datasets","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-12T12:04:12.942661Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2411.17584"},"observation_digest":"sha256:366d6cc366620e35b48614ab5e82e5696f6829859de46df8dc90cfcc0c16a138","observation_id":"00d26b8c-dd1e-47c8-b016-cab1d2aeff44","resolution":{"observed_at":"2026-08-12T12:04:12.942661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-12T10:46:46.900794Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2411.18941","last_updated":"2025-03-20T15:57:02Z","snapshot_observed_at":"2026-08-12T10:41:05.778280Z","submitted_at":"2024-11-28T06:18:31Z","title":"Revealing Key Details to See Differences: A Novel Prototypical Perspective for Skeleton-based Action Recognition","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-12T10:46:46.900794Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2411.18941"},"observation_digest":"sha256:dd4c24ac584d9cd7b8cb5ea8b598c80916507f83129afd81d9303c2f5773afdd","observation_id":"9d2d4d4a-cd1f-4c1f-a008-d0511d3f86b8","resolution":{"observed_at":"2026-08-12T10:46:46.900794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-12T05:37:02.891405Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.00277","last_updated":"2024-12-03T12:04:07Z","snapshot_observed_at":"2026-08-12T05:30:18.144247Z","submitted_at":"2024-11-29T23:12:38Z","title":"Facial Expression Recognition with Controlled Privacy Preservation and Feature Compensation","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-12T05:37:02.891405Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.00277"},"observation_digest":"sha256:ee14dd3f557d0bca910f314af5bc73fb89065961ccc9d2f9df132896245d7b05","observation_id":"f68cf49f-b999-4e4b-a0e1-41b2e388ce3f","resolution":{"observed_at":"2026-08-12T05:37:02.891405Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-12T01:00:10.558141Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.01798","last_updated":"2025-04-17T02:23:52Z","snapshot_observed_at":"2026-08-12T00:52:54.446203Z","submitted_at":"2024-12-02T18:46:12Z","title":"SEAL: Semantic Attention Learning for Long Video Representation","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-12T01:00:10.558141Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.01798"},"observation_digest":"sha256:6be72035978b0e0eb3250428f8f966c269f19ab2405f270ad34825cfc2041d59","observation_id":"2a763bf2-463c-4244-8c2b-2dc521eabbae","resolution":{"observed_at":"2026-08-12T01:00:10.558141Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T23:19:11.514948Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02611","last_updated":"2024-12-03T17:41:23Z","snapshot_observed_at":"2026-08-12T12:13:39.433245Z","submitted_at":"2024-12-03T17:41:23Z","title":"AV-Odyssey Bench: Can Your Multimodal LLMs Really Understand Audio-Visual Information?","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T23:19:11.514948Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.02611"},"observation_digest":"sha256:1914ac38156cd82b8a0cb967392435df7cca8e5a11779739b4c36d0a6d6fe3a7","observation_id":"18fcb114-1d11-401a-abe2-b17246732956","resolution":{"observed_at":"2026-08-11T23:19:11.514948Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T21:37:57.665775Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04273","last_updated":"2024-12-05T15:55:23Z","snapshot_observed_at":"2026-08-11T21:49:55.508827Z","submitted_at":"2024-12-05T15:55:23Z","title":"Reinforcement Learning from Wild Animal Videos","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-08-11T21:37:57.665775Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.04273"},"observation_digest":"sha256:71f33f164e8dd1d2b8100512803da847d63336869919b741fb5d2b34e1bd19ff","observation_id":"417b4425-52c9-4e1a-8580-5220635c3a28","resolution":{"observed_at":"2026-08-11T21:37:57.665775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T21:30:08.311855Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.04432","last_updated":"2024-12-05T18:53:04Z","snapshot_observed_at":"2026-08-12T06:57:28.869928Z","submitted_at":"2024-12-05T18:53:04Z","title":"Divot: Diffusion Powers Video Tokenizer for Comprehension and Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T21:30:08.311855Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.04432"},"observation_digest":"sha256:f70ec521a66c187d4634df0dfed6fa8f93bdafa2702959d34765e4ed6a3b08ce","observation_id":"29bb5ce6-43a3-407e-b862-90e29103bc8e","resolution":{"observed_at":"2026-08-11T21:30:08.311855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T22:52:57.159339Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.04508","last_updated":"2024-12-11T07:45:38Z","snapshot_observed_at":"2026-08-11T22:47:27.624755Z","submitted_at":"2024-12-04T05:25:17Z","title":"Video Quality Assessment: A Comprehensive Survey","version":2},"reference_index":149,"source":"pdf_text","source_observed_at":"2026-08-11T22:52:57.159339Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.04508"},"observation_digest":"sha256:e6275e75e06c1694777a3491b386c74c9271593969492dc34337ecc379dedab3","observation_id":"a3f0f396-5eab-40eb-966e-47fffa8d0eba","resolution":{"observed_at":"2026-08-11T22:52:57.159339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T20:28:44.782737Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.05766","last_updated":"2024-12-08T00:21:37Z","snapshot_observed_at":"2026-08-12T02:50:21.545843Z","submitted_at":"2024-12-08T00:21:37Z","title":"Policy-shaped prediction: avoiding distractions in model-based reinforcement learning","version":1},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T20:28:44.782737Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.05766"},"observation_digest":"sha256:4c39c2ccd00908a287799b50ca3ecc83d0dfbf6a3449b9601d3d64d0a1a98ee7","observation_id":"4c35734f-9b59-49d9-a1d7-97b26f67b1fe","resolution":{"observed_at":"2026-08-11T20:28:44.782737Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T19:33:09.211041Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.06674","last_updated":"2024-12-09T17:12:22Z","snapshot_observed_at":"2026-08-11T19:23:10.528209Z","submitted_at":"2024-12-09T17:12:22Z","title":"EMOv2: Pushing 5M Vision Model Frontier","version":1},"reference_index":110,"source":"pdf_text","source_observed_at":"2026-08-11T19:33:09.211041Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.06674"},"observation_digest":"sha256:fcb69b0f120cf0540faf811310c4aa82adda952047d536fb25731f861165c23f","observation_id":"6b742f44-9ee3-4274-b04b-5aa24c3bcfdd","resolution":{"observed_at":"2026-08-11T19:33:09.211041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2412.07157","last_updated":"2026-04-26T01:56:27Z","snapshot_observed_at":"2026-07-06T20:04:25.198952Z","submitted_at":"2024-12-10T03:34:56Z","title":"Multi-Scale Contrastive Learning for Video Temporal Grounding","version":3},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-23T07:29:46.573683Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.07157"},"observation_digest":"sha256:2180830cb84fdc4712279cf381c478dd25af1611af4dd5df8005e003931deaca","observation_id":"85e977c6-4704-453a-a382-a0928ae3b543","resolution":{"observed_at":"2026-05-23T07:32:43.017525Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T18:59:28.411638Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.07233","last_updated":"2024-12-10T06:44:44Z","snapshot_observed_at":"2026-08-11T18:53:44.816419Z","submitted_at":"2024-12-10T06:44:44Z","title":"Repetitive Action Counting with Hybrid Temporal Relation Modeling","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T18:59:28.411638Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.07233"},"observation_digest":"sha256:beb6ade04a2e79f7ee90021643d4d547b0c96ec19a14bbe442eacf640b7a7712","observation_id":"2afb1b5a-64f7-4b61-8108-5ad117bd45eb","resolution":{"observed_at":"2026-08-11T18:59:28.411638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T17:17:35.287361Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.09202","last_updated":"2024-12-13T06:38:45Z","snapshot_observed_at":"2026-08-12T14:08:54.511812Z","submitted_at":"2024-12-12T11:56:24Z","title":"Temporal Action Localization with Cross Layer Task Decoupling and Refinement","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T17:17:35.287361Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.09202"},"observation_digest":"sha256:62ca8061bbc9212df68df0fb762ebe49262d89da16bf2e6ba20b6da2ca6bc1ac","observation_id":"ea74e1ec-980f-41ce-845f-bf856b45dfd2","resolution":{"observed_at":"2026-08-11T17:17:35.287361Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T16:41:35.431226Z","title":"arXiv preprint arXiv:1705.06950","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.09895","last_updated":"2025-02-09T12:42:37Z","snapshot_observed_at":"2026-08-11T16:33:39.923630Z","submitted_at":"2024-12-13T06:30:52Z","title":"Building a Multi-modal Spatiotemporal Expert for Zero-shot Action Recognition with CLIP","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T16:41:35.431226Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.09895"},"observation_digest":"sha256:b5df801cb8921aba36c7debd4755b66766e0c45915c5c7b13d81b38858e6c6ca","observation_id":"3649627a-c22f-4a9b-9bf1-6911b23e172c","resolution":{"observed_at":"2026-08-11T16:41:35.431226Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T17:59:36.471459Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.10443","last_updated":"2025-03-11T03:19:42Z","snapshot_observed_at":"2026-08-11T17:49:51.021426Z","submitted_at":"2024-12-11T13:48:06Z","title":"SweetTok: Semantic-Aware Spatial-Temporal Tokenizer for Compact Video Discretization","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T17:59:36.471459Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.10443"},"observation_digest":"sha256:8f937f5d76049224d1a2b53838fd3d9b0a03309863f624e30e9e2e35f0f3d4d6","observation_id":"e6641644-3148-462f-8aec-51579427366d","resolution":{"observed_at":"2026-08-11T17:59:36.471459Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2412.11149","last_updated":"2026-05-16T08:35:47Z","snapshot_observed_at":"2026-07-06T20:07:19.192945Z","submitted_at":"2024-12-15T10:47:26Z","title":"A Comprehensive Survey of Action Quality Assessment: Method and Benchmark","version":2},"reference_index":122,"source":"pdf_text","source_observed_at":"2026-05-23T06:54:53.363706Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.11149"},"observation_digest":"sha256:8f7943d2126112dd87436a633ea81f90152ad1bce983beecfe157f3349d67f11","observation_id":"46b2e2d0-d151-4950-b4aa-2fa7a237646f","resolution":{"observed_at":"2026-05-23T06:55:28.123232Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T15:13:04.161574Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.11228","last_updated":"2024-12-15T15:51:44Z","snapshot_observed_at":"2026-08-11T15:07:25.905238Z","submitted_at":"2024-12-15T15:51:44Z","title":"Uni-AdaFocus: Spatial-temporal Dynamic Computation for Video Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T15:13:04.161574Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.11228"},"observation_digest":"sha256:b2224d71e24d143d4f36608c093fe4b424bd86d559816fd45db172f04e7c00db","observation_id":"e455f3ef-f987-41d7-9f7b-dca5c9950f0f","resolution":{"observed_at":"2026-08-11T15:13:04.161574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T14:53:18.905903Z","title":"The ki- netics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.11553","last_updated":"2025-05-12T19:55:49Z","snapshot_observed_at":"2026-08-12T09:08:21.152603Z","submitted_at":"2024-12-16T08:37:58Z","title":"Training Strategies for Isolated Sign Language Recognition","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T14:53:18.905903Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.11553"},"observation_digest":"sha256:3194f86b6e0f6fa016ec30f13c4b95a27e730da48fb1536aeb9ac16255016351","observation_id":"5d2a4750-a70e-4575-82f7-752ef7f4d18e","resolution":{"observed_at":"2026-08-11T14:53:18.905903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T14:31:23.922961Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.11959","last_updated":"2025-02-12T13:25:10Z","snapshot_observed_at":"2026-08-11T19:08:39.712598Z","submitted_at":"2024-12-16T16:41:51Z","title":"Gramian Multimodal Representation Learning and Alignment","version":2},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T14:31:23.922961Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.11959"},"observation_digest":"sha256:dc31fe8dc00d1b86eec5d7bc7932725a5abb7787e132702c10353a90a29864d2","observation_id":"4e8771a2-b63b-4951-b765-e89b3ba021d3","resolution":{"observed_at":"2026-08-11T14:31:23.922961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T13:44:50.152682Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.12833","last_updated":"2025-05-28T09:22:24Z","snapshot_observed_at":"2026-08-11T17:45:15.774121Z","submitted_at":"2024-12-17T11:54:47Z","title":"FocusChat: Text-guided Long Video Understanding via Spatiotemporal Information Filtering","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T13:44:50.152682Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.12833"},"observation_digest":"sha256:b6491cad9ff15e6e34f546013b88faef4cc40466c1dc6b582bd2606947f97482","observation_id":"730ded9d-3710-4b50-a4b5-2f055009d5b3","resolution":{"observed_at":"2026-08-11T13:44:50.152682Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T13:24:29.917626Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13185","last_updated":"2024-12-17T18:58:07Z","snapshot_observed_at":"2026-08-11T13:18:27.369149Z","submitted_at":"2024-12-17T18:58:07Z","title":"Move-in-2D: 2D-Conditioned Human Motion Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T13:24:29.917626Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.13185"},"observation_digest":"sha256:0d2b2c1c9c1b63b0487151ed7091ffe5b75c27be33ca7589c82e2f2fd61465a2","observation_id":"c655a56d-450a-4ac0-9dd3-2d96b01c124c","resolution":{"observed_at":"2026-08-11T13:24:29.917626Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T13:05:30.131913Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13543","last_updated":"2024-12-18T06:43:06Z","snapshot_observed_at":"2026-08-12T14:37:47.231867Z","submitted_at":"2024-12-18T06:43:06Z","title":"Query-centric Audio-Visual Cognition Network for Moment Retrieval, Segmentation and Step-Captioning","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T13:05:30.131913Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.13543"},"observation_digest":"sha256:7b69359caff04b08c268739604cdacf346025adfef1618a0786def5901137f54","observation_id":"432e0ef8-a3cf-4b05-bc43-518b6d5f804b","resolution":{"observed_at":"2026-08-11T13:05:30.131913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T12:55:40.519804Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13708","last_updated":"2025-02-03T12:27:21Z","snapshot_observed_at":"2026-08-11T12:50:23.483212Z","submitted_at":"2024-12-18T10:51:31Z","title":"JoVALE: Detecting Human Actions in Video Using Audiovisual and Language Contexts","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T12:55:40.519804Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.13708"},"observation_digest":"sha256:7945c041e93709dd2b2baa33b8d18b415cb9d535cca835c4d8b397c58c89a973","observation_id":"dffa1ae0-5344-414f-aa9e-422b17c87bfa","resolution":{"observed_at":"2026-08-11T12:55:40.519804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T12:47:17.426146Z","title":"arXiv preprint arXiv:1705.06950 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.13845","last_updated":"2025-02-24T03:37:59Z","snapshot_observed_at":"2026-08-11T14:35:32.643550Z","submitted_at":"2024-12-18T13:38:06Z","title":"Do Language Models Understand Time?","version":3},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-11T12:47:17.426146Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.13845"},"observation_digest":"sha256:2018f2ee1ce90e71f19389fcb26d1d3e8940bbea931da043b44d59096ade1076","observation_id":"0f7c108f-9abf-4afa-aeef-d5735b6cf217","resolution":{"observed_at":"2026-08-11T12:47:17.426146Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T11:48:07.167213Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.14965","last_updated":"2025-01-11T14:08:22Z","snapshot_observed_at":"2026-08-12T14:08:49.792642Z","submitted_at":"2024-12-19T15:44:04Z","title":"Movie2Story: A framework for understanding videos and telling stories in the form of novel text","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T11:48:07.167213Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.14965"},"observation_digest":"sha256:28e0f3433a39f6e85cf56407f13f3b0e539520998e252ad347cae95eaa1a24b5","observation_id":"2ed91dd6-bca6-42cd-a65d-adfc38ce79bd","resolution":{"observed_at":"2026-08-11T11:48:07.167213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T11:47:56.159595Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.15023","last_updated":"2025-05-05T16:55:53Z","snapshot_observed_at":"2026-08-12T01:15:28.643181Z","submitted_at":"2024-12-19T16:37:19Z","title":"FolAI: Synchronized Foley Sound Generation with Semantic and Temporal Alignment","version":3},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-11T11:47:56.159595Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.15023"},"observation_digest":"sha256:6dbe73294dd2c305edfc9e2ae58b0a05145446a17b11f565c2191d6d11956690","observation_id":"ce3ccac1-d5a8-4c92-98e9-6380c20126b4","resolution":{"observed_at":"2026-08-11T11:47:56.159595Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T10:51:37.828623Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16275","last_updated":"2024-12-20T17:16:15Z","snapshot_observed_at":"2026-08-11T10:47:01.607253Z","submitted_at":"2024-12-20T17:16:15Z","title":"LEARN: A Unified Framework for Multi-Task Domain Adapt Few-Shot Learning","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T10:51:37.828623Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.16275"},"observation_digest":"sha256:9be2b21082b46e11e2d1e4b857633c7f43870d57aaaa89d547093c11c63a561e","observation_id":"b37a41cc-5a2a-4555-9113-211bedc6804c","resolution":{"observed_at":"2026-08-11T10:51:37.828623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T10:37:19.888909Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.888909Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:0ae389ef2b847d0eaab9da806cccac437ad38c6a3926f5a2cec5b6f2d694f602","observation_id":"5db4cb8a-494b-46fc-ad12-514e57ff39f4","resolution":{"observed_at":"2026-08-11T10:37:19.888909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T12:18:42.518484Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.17847","last_updated":"2025-02-19T03:05:56Z","snapshot_observed_at":"2026-08-11T15:06:50.062800Z","submitted_at":"2024-12-19T01:30:19Z","title":"Bridging the Data Provenance Gap Across Text, Speech and Video","version":2},"reference_index":227,"source":"pdf_text","source_observed_at":"2026-08-11T12:18:42.518484Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.17847"},"observation_digest":"sha256:cc52a18a2311c56d767d28969f5e699a9ac6370c67dbab64c70163559562297b","observation_id":"f3fa4202-b19f-4a1f-8204-360d098e7c60","resolution":{"observed_at":"2026-08-11T12:18:42.518484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T04:45:38.407479Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.18386","last_updated":"2025-04-22T13:23:34Z","snapshot_observed_at":"2026-08-11T04:40:02.184274Z","submitted_at":"2024-12-24T12:16:43Z","title":"Switch-a-View: View Selection Learned from Unlabeled In-the-wild Videos","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T04:45:38.407479Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.18386"},"observation_digest":"sha256:5378534bdf7d0160cd1292dff7cc2644f2518113c37af2fa82e7af9d97c35647","observation_id":"69ac8b99-ec3e-497d-b179-95fc419abde4","resolution":{"observed_at":"2026-08-11T04:45:38.407479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-10T23:42:11.699030Z","title":"arXiv preprint arXiv:1705.06950 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.20042","last_updated":"2024-12-28T06:13:44Z","snapshot_observed_at":"2026-08-10T23:35:02.327718Z","submitted_at":"2024-12-28T06:13:44Z","title":"DAVE: Diverse Atomic Visual Elements Dataset with High Representation of Vulnerable Road Users in Complex and Unpredictable Environments","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-10T23:42:11.699030Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.20042"},"observation_digest":"sha256:81efc3ab6bfd8b76892e7cafb3d32bdfdda32eba47bd7fc40dca9bfbd4b68b48","observation_id":"da4764c2-4baa-4cbb-9c44-0458be7bf882","resolution":{"observed_at":"2026-08-10T23:42:11.699030Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-10T22:56:23.750838Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.00432","last_updated":"2024-12-31T13:22:00Z","snapshot_observed_at":"2026-08-11T04:00:32.305205Z","submitted_at":"2024-12-31T13:22:00Z","title":"OV-HHIR: Open Vocabulary Human Interaction Recognition Using Cross-modal Integration of Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-10T22:56:23.750838Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.00432"},"observation_digest":"sha256:f8acc75422b1038be0b0b5527288bf2b2d8e212fe969ec333d9b10bb4566bc60","observation_id":"b0c9739a-7184-421c-ac69-12b35725793c","resolution":{"observed_at":"2026-08-10T22:56:23.750838Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2501.00574","last_updated":"2025-07-13T16:21:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-12-31T18:01:23Z","title":"VideoChat-Flash: Hierarchical Compression for Long-Context Video Modeling","version":4},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-18T04:02:43.261543Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.00574"},"observation_digest":"sha256:3fffef18dfb68821e0a27dc297a051bf0f587540c744079f8b846aaf0b4499d0","observation_id":"77257d2f-6ebe-424c-99c5-ee5a0d83ca59","resolution":{"observed_at":"2026-05-18T04:02:43.404573Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-10T21:18:08.460067Z","title":"The kinetics human action video dataset.arXiv preprint arXiv:1705.06950,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.05453","last_updated":"2025-01-09T18:59:58Z","snapshot_observed_at":"2026-08-11T03:37:37.823382Z","submitted_at":"2025-01-09T18:59:58Z","title":"An Empirical Study of Autoregressive Pre-training from Videos","version":1},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-10T21:18:08.460067Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.05453"},"observation_digest":"sha256:803cd29073176cabb0a415aa2f01fbcb65b35f5b6b67eff158acdfa4e8973fdc","observation_id":"06619f79-214b-48fe-b95c-86df15aa6a53","resolution":{"observed_at":"2026-08-10T21:18:08.460067Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-10T21:09:24.570842Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.05936","last_updated":"2025-01-10T12:57:33Z","snapshot_observed_at":"2026-08-12T14:05:12.854238Z","submitted_at":"2025-01-10T12:57:33Z","title":"A Multimodal Dataset for Enhancing Industrial Task Monitoring and Engagement Prediction","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-10T21:09:24.570842Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.05936"},"observation_digest":"sha256:aee55b2fd30f0ca2da7fa19b45abc6451bdae4ad0e15d95c91995e87e8605a34","observation_id":"52026dd1-d33e-497e-bf8e-46f3fb44f197","resolution":{"observed_at":"2026-08-10T21:09:24.570842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-10T20:11:06.832952Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.09304","last_updated":"2025-01-16T05:39:28Z","snapshot_observed_at":"2026-08-10T20:04:04.044879Z","submitted_at":"2025-01-16T05:39:28Z","title":"Finding the Trigger: Causal Abductive Reasoning on Video Events","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-10T20:11:06.832952Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.09304"},"observation_digest":"sha256:53a60670135cc9d1423064ad996bcf83d6d583e5fb79b41f3a1c15bc96fbcbec","observation_id":"38fd05ae-ae83-4b94-8327-716f3b7d437b","resolution":{"observed_at":"2026-08-10T20:11:06.832952Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-10T17:25:52.911613Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.12218","last_updated":"2025-04-20T14:33:55Z","snapshot_observed_at":"2026-08-10T17:21:06.582607Z","submitted_at":"2025-01-21T15:39:40Z","title":"Exploring Temporally-Aware Features for Point Tracking","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-10T17:25:52.911613Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.12218"},"observation_digest":"sha256:36fc9d825ec49c722652fb4a22dd1f2ca011034cc2f5bbb56205a3db26c78f3f","observation_id":"2e2af75a-2598-4448-90b0-324a90626f73","resolution":{"observed_at":"2026-08-10T17:25:52.911613Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2501.12386","last_updated":"2025-07-13T18:57:17Z","snapshot_observed_at":"2026-08-06T07:17:05.291678Z","submitted_at":"2025-01-21T18:59:00Z","title":"InternVideo2.5: Empowering Video MLLMs with Long and Rich Context Modeling","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-17T02:52:20.643070Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.12386"},"observation_digest":"sha256:e57a0c0487016920adbce74b57f10e3b3b37862e6bfb815bb10a023c5f103100","observation_id":"18c528c3-c6ae-451a-aef5-04f7daf09b2f","resolution":{"observed_at":"2026-05-17T02:52:20.727050Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-10T16:57:36.835237Z","title":"CoRR abs/1705.06950 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.12681","last_updated":"2025-01-22T06:59:46Z","snapshot_observed_at":"2026-08-12T05:57:03.740500Z","submitted_at":"2025-01-22T06:59:46Z","title":"Can masking background and object reduce static bias for zero-shot action recognition?","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-10T16:57:36.835237Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.12681"},"observation_digest":"sha256:34dd473cd985f127ecf02a635a4858d57b4693ac398a70a01e67efb516bde8ef","observation_id":"9a610fa4-9bfe-4141-a3ce-296f84ca04a2","resolution":{"observed_at":"2026-08-10T16:57:36.835237Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-10T16:32:15.590224Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2501.13066","last_updated":"2025-01-22T18:21:55Z","snapshot_observed_at":"2026-08-12T05:56:36.717745Z","submitted_at":"2025-01-22T18:21:55Z","title":"SMART-Vision: Survey of Modern Action Recognition Techniques in Vision","version":1},"reference_index":190,"source":"pdf_text","source_observed_at":"2026-08-10T16:32:15.590224Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.13066"},"observation_digest":"sha256:4a137f5d3294c48eecf1e6e073230b463ae5c376d3c76e23fbf68226fa344bf6","observation_id":"b0753603-f80b-4e07-b7ec-3e0846206dcd","resolution":{"observed_at":"2026-08-10T16:32:15.590224Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-09T21:30:04.006457Z","title":"The kinetics hu- man action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2501.19061","last_updated":"2025-03-30T02:44:43Z","snapshot_observed_at":"2026-08-10T20:51:25.702157Z","submitted_at":"2025-01-31T11:48:22Z","title":"EgoMe: A New Dataset and Challenge for Following Me via Egocentric View in Real World","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-09T21:30:04.006457Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2501.19061"},"observation_digest":"sha256:f54376ea1c444dbe302b0fc8d6a1270f79d52075fe029e69aeb4cafce7dd103a","observation_id":"7db8eaf7-f030-4d91-9cec-5c5cb9f27119","resolution":{"observed_at":"2026-08-09T21:30:04.006457Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-09T19:13:03.386650Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.00397","last_updated":"2025-02-01T11:05:28Z","snapshot_observed_at":"2026-08-12T07:06:08.871369Z","submitted_at":"2025-02-01T11:05:28Z","title":"Minimalistic Video Saliency Prediction via Efficient Decoder & Spatio Temporal Action Cues","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-09T19:13:03.386650Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.00397"},"observation_digest":"sha256:a1163ea9a702a7ab5726bdc7b50061f405f8537df6cfa468b7bf60dc22e2a531","observation_id":"419474bc-90d4-42ff-9124-9fdff43a794f","resolution":{"observed_at":"2026-08-09T19:13:03.386650Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-09T18:51:12.505546Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.00500","last_updated":"2025-02-04T15:19:12Z","snapshot_observed_at":"2026-08-10T02:49:33.781140Z","submitted_at":"2025-02-01T17:40:11Z","title":"Video Latent Flow Matching: Optimal Polynomial Projections for Video Interpolation and Extrapolation","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-09T18:51:12.505546Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.00500"},"observation_digest":"sha256:f6c9b9c99ee06bb1b9245613c3917f5a0c929cf4083f4d532814e3143e31b88e","observation_id":"07cbbba7-8202-424d-8335-0b1d4b1f9f0a","resolution":{"observed_at":"2026-08-09T18:51:12.505546Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-09T13:20:29.321787Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02118","last_updated":"2025-02-04T08:54:06Z","snapshot_observed_at":"2026-08-09T13:14:20.132781Z","submitted_at":"2025-02-04T08:54:06Z","title":"BRIDLE: Generalized Self-supervised Learning with Quantization","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-09T13:20:29.321787Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.02118"},"observation_digest":"sha256:1a2d0ee1902742dececba9785792fe4e5199a8d34faa58f0203d6bef3cea75a2","observation_id":"44aba60f-d01b-433b-9c5e-3580d0612c1d","resolution":{"observed_at":"2026-08-09T13:20:29.321787Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-09T11:02:54.887467Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.02817","last_updated":"2025-02-05T01:33:24Z","snapshot_observed_at":"2026-08-09T10:57:33.643878Z","submitted_at":"2025-02-05T01:33:24Z","title":"A Decade of Action Quality Assessment: Largest Systematic Survey of Trends, Challenges, and Future Directions","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-09T11:02:54.887467Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.02817"},"observation_digest":"sha256:c00325699d660410c212f42c328f34f0638c761ccfc9c55ad0020f96f0cb60fc","observation_id":"ca91d963-cbfc-40d2-abbd-9b8acec5fcc4","resolution":{"observed_at":"2026-08-09T11:02:54.887467Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-09T04:44:58.806472Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.03459","last_updated":"2025-02-05T18:57:04Z","snapshot_observed_at":"2026-08-09T18:52:00.002531Z","submitted_at":"2025-02-05T18:57:04Z","title":"SKI Models: Skeleton Induced Vision-Language Embeddings for Understanding Activities of Daily Living","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-09T04:44:58.806472Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.03459"},"observation_digest":"sha256:7a049e243752030bdf83f08c1a20b4203bc236dfafd56d5be2d6b67c555eb33a","observation_id":"c58284bd-b098-4379-af3f-343171e0e46b","resolution":{"observed_at":"2026-08-09T04:44:58.806472Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-09T04:37:09.649514Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.03549","last_updated":"2025-02-10T03:28:56Z","snapshot_observed_at":"2026-08-12T10:25:58.985174Z","submitted_at":"2025-02-05T19:03:58Z","title":"Kronecker Mask and Interpretive Prompts are Language-Action Video Learners","version":3},"reference_index":2014,"source":"pdf_text","source_observed_at":"2026-08-09T04:37:09.649514Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.03549"},"observation_digest":"sha256:3fe5a75d3febc21e9e026e42d617eafc126d8dbe181ec017f8df5bc3a2983b8f","observation_id":"e430e668-dc8c-474e-b363-2c660d5577ae","resolution":{"observed_at":"2026-08-09T04:37:09.649514Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-08T23:40:21.550393Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.04076","last_updated":"2025-02-06T13:41:24Z","snapshot_observed_at":"2026-08-11T13:13:50.806418Z","submitted_at":"2025-02-06T13:41:24Z","title":"Content-Rich AIGC Video Quality Assessment via Intricate Text Alignment and Motion-Aware Consistency","version":1},"reference_index":2000,"source":"pdf_text","source_observed_at":"2026-08-08T23:40:21.550393Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.04076"},"observation_digest":"sha256:38c377cf397fab67dd55330bd90e4746f138abf5834ccc8499d1732248873816","observation_id":"19de4fc0-0c87-4f11-8229-4f01711a7157","resolution":{"observed_at":"2026-08-08T23:40:21.550393Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-08T20:06:35.140418Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.05173","last_updated":"2025-05-30T03:54:16Z","snapshot_observed_at":"2026-08-09T16:45:21.957564Z","submitted_at":"2025-02-07T18:56:04Z","title":"VideoRoPE: What Makes for Good Video Rotary Position Embedding?","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T20:06:35.140418Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.05173"},"observation_digest":"sha256:5dd793c162217da9977ddb9e244ec09d34eca646e7edd7a95a0072be4815564f","observation_id":"23cc5c99-1f77-4c8e-bf47-d466a50145bb","resolution":{"observed_at":"2026-08-08T20:06:35.140418Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-08T21:12:23.227462Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.05240","last_updated":"2025-02-12T14:43:02Z","snapshot_observed_at":"2026-08-10T00:38:45.519768Z","submitted_at":"2025-02-07T12:18:20Z","title":"Survey on AI-Generated Media Detection: From Non-MLLM to MLLM","version":2},"reference_index":189,"source":"pdf_text","source_observed_at":"2026-08-08T21:12:23.227462Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.05240"},"observation_digest":"sha256:c5e56f6ac3f82bb3a184c15907e619fc05ff8ccc84fa9b0c632add9ebef89a5e","observation_id":"09a43dbf-56e4-4a29-9409-9957ed218913","resolution":{"observed_at":"2026-08-08T21:12:23.227462Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2502.06764","last_updated":"2025-07-24T03:58:47Z","snapshot_observed_at":"2026-08-07T11:01:49.684719Z","submitted_at":"2025-02-10T18:44:25Z","title":"History-Guided Video Diffusion","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-05-16T12:00:14.672729Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.06764"},"observation_digest":"sha256:3b35b83930ec753210c3da7374ee0519f420276177af3c2098e1d691113b6b51","observation_id":"bd02daf7-5c70-4ce9-99ba-fc084884e6ba","resolution":{"observed_at":"2026-05-16T12:00:14.738091Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-08T13:40:59.626623Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07161","last_updated":"2025-02-11T00:59:30Z","snapshot_observed_at":"2026-08-10T20:46:33.386314Z","submitted_at":"2025-02-11T00:59:30Z","title":"A Survey on Mamba Architecture for Vision Applications","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-08T13:40:59.626623Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.07161"},"observation_digest":"sha256:f8efad51c49a8ac6541ad5c0852b08b50c117c8940df279fb7894e6b2437ac7a","observation_id":"aa0d2196-c9df-48fe-8bb3-a07933ead893","resolution":{"observed_at":"2026-08-08T13:40:59.626623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-08T13:18:19.187363Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07277","last_updated":"2025-02-11T05:44:50Z","snapshot_observed_at":"2026-08-11T02:23:08.903006Z","submitted_at":"2025-02-11T05:44:50Z","title":"Enhancing Video Understanding: Deep Neural Networks for Spatiotemporal Analysis","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-08T13:18:19.187363Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.07277"},"observation_digest":"sha256:943c16f16e72e599a997d7d010415dc8a832c5603293d4a186fea3fe551b3e90","observation_id":"bc1a8ea5-09ee-4b2c-93de-9219d656e534","resolution":{"observed_at":"2026-08-08T13:18:19.187363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-08T19:17:39.629499Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.07811","last_updated":"2025-02-08T06:15:39Z","snapshot_observed_at":"2026-08-08T19:11:38.138807Z","submitted_at":"2025-02-08T06:15:39Z","title":"CrossVideoMAE: Self-Supervised Image-Video Representation Learning with Masked Autoencoders","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-08T19:17:39.629499Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.07811"},"observation_digest":"sha256:bbdaa821625fcbbca4d090e306fc940f07f2f25e5e68aca4b7dd3ebf9ac5e889","observation_id":"c873d323-5d1e-45bd-805a-8dcc16c1fcc4","resolution":{"observed_at":"2026-08-08T19:17:39.629499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-08T05:57:41.666094Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.08234","last_updated":"2025-02-12T09:21:40Z","snapshot_observed_at":"2026-08-08T05:52:26.698219Z","submitted_at":"2025-02-12T09:21:40Z","title":"Learning Human Skill Generators at Key-Step Levels","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T05:57:41.666094Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.08234"},"observation_digest":"sha256:0a81faf183330be405f2872a465347d527bd892fb510d702329218fb41309022","observation_id":"8c33e2b3-915b-4fde-bc74-803c9be71552","resolution":{"observed_at":"2026-08-08T05:57:41.666094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T21:51:15.891038Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.09356","last_updated":"2025-06-04T14:07:47Z","snapshot_observed_at":"2026-08-08T11:15:58.406521Z","submitted_at":"2025-02-13T14:21:03Z","title":"Galileo: Learning Global & Local Features of Many Remote Sensing Modalities","version":3},"reference_index":2016,"source":"pdf_text","source_observed_at":"2026-08-07T21:51:15.891038Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.09356"},"observation_digest":"sha256:8154c1b91a895c9d91e365c47937e6eddcf7aa095f8158969ae0589bc9fa1786","observation_id":"91601258-5815-4711-94c0-2bff4802e973","resolution":{"observed_at":"2026-08-07T21:51:15.891038Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T19:43:09.813807Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.10047","last_updated":"2025-02-14T09:49:52Z","snapshot_observed_at":"2026-08-12T08:03:48.015468Z","submitted_at":"2025-02-14T09:49:52Z","title":"Janus: Collaborative Vision Transformer Under Dynamic Network Environment","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T19:43:09.813807Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.10047"},"observation_digest":"sha256:ed5e1dd6c8d940e61d08f43edbd6cbbd8542fa2e997bebcdfd83289a2f971e9f","observation_id":"cd7bdd5f-97f7-4d77-81f7-5f8ae25c411d","resolution":{"observed_at":"2026-08-07T19:43:09.813807Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-10T16:33:24.324204Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2502.15712","last_updated":"2025-01-22T18:32:12Z","snapshot_observed_at":"2026-08-11T02:26:05.375139Z","submitted_at":"2025-01-22T18:32:12Z","title":"GPUs, CPUs, and... NICs: Rethinking the Network's Role in Serving Complex AI Pipelines","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-10T16:33:24.324204Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2502.15712"},"observation_digest":"sha256:ffe94b497f61aaf8f582cd6af4799b0f0babef2f5e97a80bad18e76ea3d67f8a","observation_id":"017cf223-cb1a-40fc-857e-f6ae3733c8bb","resolution":{"observed_at":"2026-08-10T16:33:24.324204Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2504.13181","last_updated":"2025-04-28T18:01:39Z","snapshot_observed_at":"2026-08-11T19:32:15.215968Z","submitted_at":"2025-04-17T17:59:57Z","title":"Perception Encoder: The best visual embeddings are not at the output of the network","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-13T22:21:15.681336Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2504.13181"},"observation_digest":"sha256:cf839b419dc6def30cdc390dfc7a789b8fb4786668cfad0d6f5415a47763547e","observation_id":"5ae5e445-67e5-4617-8319-a4905f982c50","resolution":{"observed_at":"2026-05-13T22:21:15.832982Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T15:23:04.107218Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.15438","last_updated":"2025-05-21T12:19:55Z","snapshot_observed_at":"2026-08-11T18:27:19.021114Z","submitted_at":"2025-05-21T12:19:55Z","title":"Bridging Sign and Spoken Languages: Pseudo Gloss Generation for Sign Language Translation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T15:23:04.107218Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.15438"},"observation_digest":"sha256:82c01ebcae1e263b277e0e8769f7b719f163903f73db35b872463e1ccf7380f6","observation_id":"9845eb95-dd9a-4751-bcf0-cdaec231bbb9","resolution":{"observed_at":"2026-08-07T15:23:04.107218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T15:14:20.889980Z","title":"arXiv preprint arXiv:1705.06950 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.15800","last_updated":"2025-05-25T17:44:44Z","snapshot_observed_at":"2026-08-09T08:24:06.276351Z","submitted_at":"2025-05-21T17:53:47Z","title":"Interspatial Attention for Efficient 4D Human Video Generation","version":2},"reference_index":2017,"source":"pdf_text","source_observed_at":"2026-08-07T15:14:20.889980Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.15800"},"observation_digest":"sha256:e6515b087a67813dad367db398e43cbe2cb70902ae5de7f226d339076f629320","observation_id":"9a5a089e-9c7c-458f-939d-a465f6299439","resolution":{"observed_at":"2026-08-07T15:14:20.889980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T15:03:22.269517Z","title":"Khemakhem, I., Kingma, D., Monti, R., and Hyvarinen, A","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16675","last_updated":"2025-05-22T13:40:00Z","snapshot_observed_at":"2026-08-12T12:27:49.219884Z","submitted_at":"2025-05-22T13:40:00Z","title":"On the Out-of-Distribution Generalization of Self-Supervised Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T15:03:22.269517Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.16675"},"observation_digest":"sha256:8f470778247e7ceb58fb11faf0ea11f21e4e1d2628e22f0442ac81564a37478e","observation_id":"279226c9-3728-450d-a7c8-0210cf6182d1","resolution":{"observed_at":"2026-08-07T15:03:22.269517Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T14:40:12.140377Z","title":"The Kinetics Human Action Video Dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18048","last_updated":"2025-05-27T15:11:07Z","snapshot_observed_at":"2026-08-11T22:50:53.245537Z","submitted_at":"2025-05-23T15:52:31Z","title":"SHARDeg: A Benchmark for Skeletal Human Action Recognition in Degraded Scenarios","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:40:12.140377Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.18048"},"observation_digest":"sha256:5a75a5278516a55d5c52c1f24f88defeaf73f3c1d98f056570785a6dcb8430af","observation_id":"31cd2d57-a595-4dd1-8fee-eba6aec04b7d","resolution":{"observed_at":"2026-08-07T14:40:12.140377Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T14:27:44.920097Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.18855","last_updated":"2025-05-24T20:09:04Z","snapshot_observed_at":"2026-08-09T21:52:56.657385Z","submitted_at":"2025-05-24T20:09:04Z","title":"Inference Compute-Optimal Video Vision Language Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-07T14:27:44.920097Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.18855"},"observation_digest":"sha256:5bf6dedc046ee0e375b5a542c4f64563c18547d9aaecceac05f2794209a0a89b","observation_id":"700f3115-d33a-482f-8868-b24cd634b6b4","resolution":{"observed_at":"2026-08-07T14:27:44.920097Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2505.19328","last_updated":"2026-04-14T11:07:41Z","snapshot_observed_at":"2026-07-06T21:30:14.357703Z","submitted_at":"2025-05-25T21:29:00Z","title":"BAH Dataset for Ambivalence/Hesitancy Recognition in Videos for Digital Behavioural Change","version":7},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-19T13:09:00.732889Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.19328"},"observation_digest":"sha256:bd3d962d6bf26552c0a64889ac7d96c7f10f84add4526b5c9f280d6da8db1017","observation_id":"8c0028bf-626a-4531-99de-be8c5909f8a6","resolution":{"observed_at":"2026-05-19T13:12:18.326940Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T14:09:31.866045Z","title":"arXiv preprint arXiv:1705.06950 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-08T11:16:13.922243Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.866045Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:feea4db089ef9bb64398bff5c42561e8e5b101c31116a019e558b63c83b5d2d9","observation_id":"4d403432-ecd7-42ff-a012-7cf19816face","resolution":{"observed_at":"2026-08-07T14:09:31.866045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T13:28:20.997061Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.21792","last_updated":"2025-05-27T21:47:20Z","snapshot_observed_at":"2026-08-09T02:20:21.111659Z","submitted_at":"2025-05-27T21:47:20Z","title":"Multimodal Federated Learning: A Survey through the Lens of Different FL Paradigms","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-07T13:28:20.997061Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.21792"},"observation_digest":"sha256:d7c9fad29aa7f040519f16139ed069e65fb4968bb105db20117090b42ffb3727","observation_id":"a9348dac-53fa-4e66-b37e-7291224ef8ad","resolution":{"observed_at":"2026-08-07T13:28:20.997061Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":"1705.06950","doi":null,"metadata_source":"pith","pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-07-09T11:16:11.423695Z","title":"The Kinetics Human Action Video Dataset","venue":"cs.CV","work_id":"c8a3de61-cfd3-4aeb-bcf7-a0372c015748","year":2017},"citing_paper":{"arxiv_id":"2505.23617","last_updated":"2026-05-10T04:23:42Z","snapshot_observed_at":"2026-08-10T22:38:07.341464Z","submitted_at":"2025-05-29T16:25:35Z","title":"One Trajectory, One Token: Grounded Video Tokenization via Panoptic Sub-object Trajectory","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-19T12:54:31.765909Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.23617"},"observation_digest":"sha256:ec84136988381799d32ee663476090cb78a13730493f37fb710ed205f42931f5","observation_id":"1988c9f9-0d42-4bc2-846d-d17e0ae13964","resolution":{"observed_at":"2026-05-19T12:57:17.867591Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T12:32:11.404740Z","title":"The kinetics human action video dataset.arXiv preprint arXiv:1705.06950, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.24346","last_updated":"2025-05-30T08:39:36Z","snapshot_observed_at":"2026-08-09T11:59:19.522063Z","submitted_at":"2025-05-30T08:39:36Z","title":"VUDG: A Dataset for Video Understanding Domain Generalization","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:32:11.404740Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.24346"},"observation_digest":"sha256:1ad6d821d7657d5bea50e078ba20bfd6d383da244e7cdaabd088a2bb8771d6a4","observation_id":"0f30c54c-a707-413a-acfd-957ef53fdc5a","resolution":{"observed_at":"2026-08-07T12:32:11.404740Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/1705.06950/citation-record","integrity":"/paper/1705.06950/integrity","json":"/paper/1705.06950/citation-record.json","paper":"/paper/1705.06950"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1603.04467","last_updated":"2016-03-16T16:57:12Z","snapshot_observed_at":"2026-07-06T04:49:28.300758Z","submitted_at":"2016-03-14T20:50:20Z","title":"TensorFlow: Large-Scale Machine Learning on Heterogeneous Distributed Systems","version":2},"cited_work":{"arxiv_id":"1603.04467","doi":"10.48550/arxiv.1603.04467","metadata_source":"pith","pith_arxiv_id":"1603.04467","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"TensorFlow: Large-Scale Machine Learning on Heterogeneous Distributed Systems","venue":"cs.DC","work_id":"91f3c09e-dae6-48ca-80c0-463dd1b1f6e1","year":2016},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"cited_paper":"/paper/1603.04467","citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:25672dbd5d889247dccacbcbf7f3d777e3d69b160900301ebd40a83df726ec2e","observation_id":"6f52cd2b-4d8d-40b3-a56d-30dffa1af93b","resolution":{"observed_at":"2026-05-11T03:13:44.684658Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-05-25T14:23:52.648378+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T14:23:52.648378+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Andriluka, L","venue":null,"work_id":"d8391ffb-b360-47aa-8501-00706e2a9b88","year":2014},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:37290b6274d9720370c84e962243cdbf799a75a529f2284d641f29fc3a909465","observation_id":"33c2ba42-1f9e-46bd-a5fd-244564430943","resolution":{"observed_at":"2026-05-14T10:54:13.172250Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Caba Heilbron, V","venue":null,"work_id":"5f939e48-1393-4698-b4de-baca64f7fab9","year":2015},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:869e7d2f9c5ac97d05946797ee32d408761fba7223d89d4d97c4a14b4855195a","observation_id":"7bd30c90-d962-48a3-92e7-1a8156b35f28","resolution":{"observed_at":"2026-05-14T10:54:13.173926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Caliskan, J","venue":null,"work_id":"c5fb5374-513f-4136-96e4-5101bd8a98b6","year":2017},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:485186de816b5d2aaace29c594470c779c9e412cd25e5872fdc31488a933a4c8","observation_id":"413ef211-f740-4bc1-871e-2da90a597391","resolution":{"observed_at":"2026-05-14T10:54:13.175563Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Carreira and A","venue":null,"work_id":"60a82d0d-048e-4c6a-adc3-946cfd5148b6","year":2017},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:93c748ab0cdd1f5eab8585502bb2886fd6925c53574000ba7a6f5646c6aa0421","observation_id":"88d06070-cebe-4a69-9636-c9be7fdd1c07","resolution":{"observed_at":"2026-05-11T03:13:44.689996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1603.09025","last_updated":"2017-02-28T00:59:42Z","snapshot_observed_at":"2026-07-06T04:51:04.562947Z","submitted_at":"2016-03-30T02:57:20Z","title":"Recurrent Batch Normalization","version":5},"cited_work":{"arxiv_id":"1603.09025","doi":null,"metadata_source":"pith","pith_arxiv_id":"1603.09025","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Recurrent Batch Normalization","venue":"cs.LG","work_id":"3c454fc6-ce22-498c-8237-9928e43f0db4","year":2016},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"cited_paper":"/paper/1603.09025","citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:7c251cb92aaeb54f7a8e43434472e3b892a1779379286a155ac534cd12e5ea6c","observation_id":"7331b3f4-631e-4800-b568-f35dc17f90a4","resolution":{"observed_at":"2026-05-11T03:13:44.644051Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Donahue, L","venue":null,"work_id":"57ff9c11-1344-4e5a-b11b-51f8d35e527c","year":2015},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:cdf797af3a6b75e6f241c8d3d0c81ee06164acce0214a2217ee8cea41e8b873a","observation_id":"1336afb5-ceef-4fd9-a61d-eb8cc5a39cf5","resolution":{"observed_at":"2026-05-11T03:13:44.697346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Everingham, S","venue":null,"work_id":"0371acda-d73a-4649-8518-890b98a5a3a6","year":2015},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:88fa9f6f0ca7302d02b14be561e759c5d095ce3ca777588f327bb8714d7d3e5a","observation_id":"84b8a939-474c-4e4a-a728-4d23c9883d1a","resolution":{"observed_at":"2026-05-11T03:13:44.701824Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Feichtenhofer, A","venue":null,"work_id":"9abd2d51-dc4a-4613-ad4e-2096e59aa829","year":2016},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:7726422a57b790315f7461ef994af2034c7a1755fed98612f57e0da9593cd992","observation_id":"f2519642-1a16-4131-a020-9cfb715cf864","resolution":{"observed_at":"2026-05-11T03:13:44.707713Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Grifﬁn, A","venue":null,"work_id":"ef441db2-e7b9-442a-b71c-d7950e81ad77","year":2007},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:c70c43a52e9884851047e1f4054c16aa4e5d5e722f732bb6a0f46be0e6dbfe0c","observation_id":"66a9b6ae-ae4d-4d49-8f23-9f8ed570d761","resolution":{"observed_at":"2026-05-11T03:13:44.712904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b520daac-b429-47a7-a117-c77ce1ae9e9e","year":2016},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:dad834d233d7965ef7dcae416cb9d2c91fa6346dd5cf588045256ed6c94d5fdd","observation_id":"1b9bc646-76ab-439b-9a39-6e7303b7e56b","resolution":{"observed_at":"2026-05-11T03:13:44.717038Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.03167","last_updated":"2015-03-02T20:44:12Z","snapshot_observed_at":"2026-07-06T04:08:54.419941Z","submitted_at":"2015-02-11T01:44:18Z","title":"Batch Normalization: Accelerating Deep Network Training by Reducing Internal Covariate Shift","version":3},"cited_work":{"arxiv_id":"1502.03167","doi":"10.48550/arxiv.1502.03167","metadata_source":"pith","pith_arxiv_id":"1502.03167","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Batch Normalization: Accelerating Deep Network Training by Reducing Internal Covariate Shift","venue":"cs.LG","work_id":"05484516-8937-4cdf-9176-7f8329ef0221","year":2015},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"cited_paper":"/paper/1502.03167","citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:ceff8c91875ce1ebcf88ee6d134e2adfbb3b28985ba45d72edd5a63b727a1965","observation_id":"339d9ba2-8577-4e0d-bf52-d7f7bf330d8a","resolution":{"observed_at":"2026-05-13T17:19:17.426681Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-07-13T20:21:08.990281+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T20:21:08.990281+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"23db536a-e243-43a5-ba34-004d04c820f4","year":2013},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:5bb691b4ecbba1e772c15ca7873c12c6ce462b7a3b73e9b446a7e91fa7bf2d85","observation_id":"964c655a-2108-4c44-8938-a52522e00d2f","resolution":{"observed_at":"2026-05-11T03:13:44.724675Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Karpathy, G","venue":null,"work_id":"f25461dd-1d3e-41a1-8091-2f6cf9ab0fda","year":2014},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:d89f30b59e76f0f56fbc34d5de1b442c9377cc7a508ef767a49e794eec8b50fe","observation_id":"0103781f-8e78-42d6-ba93-abd6b926ef69","resolution":{"observed_at":"2026-05-11T03:13:44.728134Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Kuehne, H","venue":null,"work_id":"f6de3c83-e6d8-40ed-85ee-19710c86ae2e","year":2011},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:d27d9074a4a0ec3e1da457bf48df4c730e2d26b8101c2f9fcf57d92f22909771","observation_id":"01ebe83c-451a-43d9-bf0d-ea4e8c8f0d37","resolution":{"observed_at":"2026-05-11T03:13:44.731765Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Laptev, M","venue":null,"work_id":"8da101f6-7c77-45b4-9f29-f3e0a841d4cd","year":2008},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:a1f2735f91551360bf278b04fcfccd09141126ad4399a25755b1c08579b892b8","observation_id":"77e2b512-0289-46af-bd6a-e7bcec0c87bb","resolution":{"observed_at":"2026-05-11T03:13:44.739145Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"bf7b943c-3cfb-479f-9aec-7e006f3ba8ea","year":2008},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:e565e4dcf4ac7dd2e32e36592e5b40e0885a5e9b891cdc362a657abe2262f9a0","observation_id":"24a26761-0219-4bae-a907-5a48ec4d3da8","resolution":{"observed_at":"2026-05-11T03:13:44.742283Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Russakovsky, J","venue":null,"work_id":"56e4f0b7-8301-46d9-ab60-fdeb727e7e58","year":2015},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:9d123af0024a82ae6b7a745290a66eb25b56ef69929e7ad86571969091782a72","observation_id":"f276bf66-5181-44c3-8590-268fe9a76abd","resolution":{"observed_at":"2026-05-11T03:13:44.745024Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Simonyan and A","venue":null,"work_id":"214e6af0-6129-4eca-968b-86c32a9220fa","year":2014},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:17df42f4527f4eefff293b85976090511185772f693fc8891b033841f7798f99","observation_id":"60bede25-e860-4af2-8d4f-d704fc396bc6","resolution":{"observed_at":"2026-05-11T03:13:44.747723Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":"1212.0402","doi":"10.48550/arxiv.1212.0402","metadata_source":"pith","pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","venue":"cs.CV","work_id":"5dfb46e7-e952-409d-a3c7-ba7f20aebad6","year":2012},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:43d94fa728811cdc56f4e89b4118477dc3e219fee513519d9ccfa5e983881c8d","observation_id":"832f6354-d6fd-4d84-90ed-68a08dc16cfb","resolution":{"observed_at":"2026-05-11T03:13:44.662695Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"41ef7e8b-7098-49d4-bd08-e230372aeef8","year":2010},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:ed01779c2e5f4553a0ced8091dafb79cf071704383ef553c5d0a0211a28b2a04","observation_id":"dda9a380-e0b5-45f9-86b0-dd1be84b3de5","resolution":{"observed_at":"2026-05-11T03:13:44.758162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Torralba and A","venue":null,"work_id":"86dbb741-bfba-4680-8b62-c810a85d34f8","year":2011},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:92958c7731810dd4daa327e07ff129913485de5047d7ad529450b194b058856f","observation_id":"e68cc174-6a22-4b78-a33f-74b95111c101","resolution":{"observed_at":"2026-05-11T03:13:44.761283Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1680026e-c875-4192-b5e2-ce836aa47616","year":2015},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:cd00d6bfdfed21f6827d0a226557e19699497d820839bf49cf44c03b6ee0e41a","observation_id":"260c037e-5c0e-47fa-9e81-9ac3364105d5","resolution":{"observed_at":"2026-05-11T03:13:44.764312Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Wang and C","venue":null,"work_id":"fa9f078e-ede7-4bab-a230-1028a4765fe6","year":2013},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:bc8d00d02faa6aeb004fe508ed297a508fe482a2c1b464a1a2c0c1d5e31c82bd","observation_id":"baee23f0-807e-4ccb-9c28-aefd5c6a3c1f","resolution":{"observed_at":"2026-05-11T03:13:44.769946Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"03d02244-744a-4512-94bd-20593ae495d1","year":2016},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:c0d7130b3f045b09d9dc9508fc7018d774f8b41969c23719709777b21a2ebb54","observation_id":"dce6766e-fdfc-47f4-8633-ceadc69ba021","resolution":{"observed_at":"2026-05-11T03:13:44.773178Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Yue-Hei Ng, M","venue":null,"work_id":"cb22f7eb-d2c8-43ad-9f76-b83e2389bee6","year":2015},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:5711f2efd15808717138065da231c274282679249710ab9420b09e3e0b23ca10","observation_id":"1a0a7faa-eee1-4383-b2ea-0da81313359c","resolution":{"observed_at":"2026-05-11T03:13:44.776213Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e01cb74b-9da2-4c8e-a4f2-b7cb767bac6f","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:358554684485555b2d34c468cdb1f58c35fe9160e59e590b06bc6a62d3441a66","observation_id":"88a67bd4-4b5f-4dbb-b46f-1341a0c73bc7","resolution":{"observed_at":"2026-05-11T03:13:44.779378Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5ecbe140-a07b-4a14-9ae8-924d1783d89f","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:3e397635ab618fec230b039b6989a2f31f62daebf6f1865d6b09090a28928c42","observation_id":"e72bc2f9-5929-4b58-a97f-c6593ccf1988","resolution":{"observed_at":"2026-05-11T03:13:44.786042Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1e5d5ece-29e9-44c0-9fbc-422b6f26e409","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:71be2f80d33c03dc0af6afad2334d9fbfb84e93e41093c34a56fb17af962e5a1","observation_id":"c6e50653-0bfa-4693-853f-f2206fcc1f25","resolution":{"observed_at":"2026-05-11T03:13:44.790226Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6a555e91-7c22-406d-b75a-f810a8cf0cc9","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:6d528169a326811ec596b92b451f21a84d07819c905b725514e7c84d0d9f27f8","observation_id":"23102a95-303d-4aa8-b343-d87957e5bfb2","resolution":{"observed_at":"2026-05-11T03:13:44.796570Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fecae73f-1fc4-413b-9359-6747173ff2bc","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:7c7a4fd3e6f595e7c0eed8237c2ea1963ae3fbfaced61579be3eb5f0042b6637","observation_id":"8b7e4b61-dc32-42a0-a1e2-63dad89fbec8","resolution":{"observed_at":"2026-05-11T03:13:44.800006Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5617e71f-145a-4ea3-9270-173e12531422","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:09bbedd92b46a64512193b4f1f9a374233b8b4f47045df5fb1c028fca3484dd5","observation_id":"5ef41aa7-0d3f-44ee-bf9d-dad18715ff63","resolution":{"observed_at":"2026-05-11T03:13:44.803262Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7cdfb4c7-a17e-40ff-8279-b68f6a0c7633","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:4a995cc853ad8af0241cdcb8be5dbea8e43f618c46ac96e12cc3199bb949cca6","observation_id":"8e004ca5-154c-4dfe-b73d-c8b00928c741","resolution":{"observed_at":"2026-05-11T03:13:44.809184Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4c2ce17d-bd23-4816-8caa-dda56b9f7964","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:248f8f95615c76880685c8794c3e813bb3d46139d6f289b6cdfb3542c5f48a61","observation_id":"867f3edb-ce80-4a27-8c7b-c8e2139bb550","resolution":{"observed_at":"2026-05-11T03:13:44.816279Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4c124f0a-42bc-4bb6-991e-fa8fba7ed3f5","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:c1f30a1b6fcc74f584dc394a9140f2753987019eaa5dc27a52b820c09a14e882","observation_id":"f1633a61-2d60-4fe4-a367-493e9d9cde3c","resolution":{"observed_at":"2026-05-11T03:13:44.819787Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"d3e9b641-afa0-4cdc-abaa-cc81adcfae82","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:c9feec6b204b935dc7177549c9202431c428879ac0c25be0592ad3f71c62771a","observation_id":"19063b95-242f-4390-be78-05813ae23db8","resolution":{"observed_at":"2026-05-11T03:13:44.826894Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cf474099-58b2-438b-a1f8-8912a3c38b64","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:6f78f398258f628497918a50c7e4c24a8fa09102a3f23e9e8be3fed06863780d","observation_id":"2099423a-ca13-42b1-a1d6-6fccbf89d763","resolution":{"observed_at":"2026-05-11T03:13:44.832161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"293e764b-561e-4a9d-b1a4-8b395d5b2a6a","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:3d53ec7e48f37b073a56dfaaf29800b5ea6b175f64b6df30e5184e4ebbd79bc4","observation_id":"b62b4a4e-2325-48dc-86ec-c1c904acc226","resolution":{"observed_at":"2026-05-11T03:13:44.836491Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"781f0ecd-1144-44af-b6f3-983e7520b5e8","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:9910bee9b059de0b186a15c6e4372d0d13d40fef4d7badebbd1fab520c0a25b4","observation_id":"6b8dfbd2-60b4-4022-9591-e3688153e6bc","resolution":{"observed_at":"2026-05-11T03:13:44.839567Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"a8aab2d9-0d1a-4f28-8388-9d22ad177808","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:95f9361fa6f34da8577eabba624caf0893345a1a5932dee4f75ad731b82128b5","observation_id":"e66bad7f-7557-457c-9430-e2c320b28b13","resolution":{"observed_at":"2026-05-11T03:13:44.844495Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fffe3c7d-0ce1-4089-8cca-8b7ef45606c3","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:8224cd48f4ea81275e170f37c1b2e1f43196fafe7a7de7c3f25c63cf09fd5253","observation_id":"fda119af-c266-450c-84c6-b13445bd3107","resolution":{"observed_at":"2026-05-11T03:13:44.848863Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"72769c60-b4df-44b7-8dd5-6efd6d77e520","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:28a461e5e2f12313b0eeb929d1540604cb117831cb319480f3de29d306a346ea","observation_id":"ebb61496-9491-49ed-8310-c696c65ae43d","resolution":{"observed_at":"2026-05-11T03:13:44.853947Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4d457fc8-3522-417f-8af8-e4809442195e","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:c3e3a73d76a208273f9d4e399e69294254a5cae02eac75f0fdcda8af9d8777de","observation_id":"b947f49f-ab9a-45de-8b38-36e7a25f348f","resolution":{"observed_at":"2026-05-11T03:13:44.857473Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fdf08c16-bc21-4504-80de-9b315b15de5b","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:aa2f419318c90be438bc95ec0b45f33f1d9c8eb2f40f1e3bcac642a594e9617a","observation_id":"a0d6e13e-58c9-4975-af09-3cbac9135450","resolution":{"observed_at":"2026-05-11T03:13:44.860660Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2e19ea91-8ef7-45c1-9a2b-5ade041cca70","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:2874847d0ec62883186f8e829ff0920e06a8f5c197342abc4b8e078ce03aecfd","observation_id":"3adccffb-7b56-4697-b0ae-d95a49982303","resolution":{"observed_at":"2026-05-11T03:13:44.863478Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b755fbf1-2254-4353-acb2-dbfafca2d558","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:ed441a82115c6578f04c8151cb111946413a92f25bed45ef6d179fcff9c8ad79","observation_id":"96e6a539-cf44-4d7c-a54d-2681150c4365","resolution":{"observed_at":"2026-05-11T03:13:44.869752Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"cf215965-529e-44fc-a3aa-928c2a8e61f3","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:4fe493c164cbdfb28938e18fcb3d34720b2f7ae23c5e6bfcc4d262913508af3c","observation_id":"f13a9f12-5fb3-49d2-9a93-cbc5d3b969af","resolution":{"observed_at":"2026-05-11T03:13:44.874804Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"543f8430-90fb-4f82-9076-682a2275ff71","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:bb0d1c21f06b247c32375708c516810d718ed1a669d55f8d9fb422d13111fdb3","observation_id":"6f08d354-90af-4088-9d8a-99a7ea8823bf","resolution":{"observed_at":"2026-05-11T03:13:44.877697Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"db813c4f-7e4e-43e8-bddf-f46e4a0b96ce","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:2d5dd31bbc2d3abf4d48160ffa9db3f0f656df1c647a83d49bc67c98dd688f2b","observation_id":"276a1eaf-9f90-4a42-9d56-8df465e163ba","resolution":{"observed_at":"2026-05-11T03:13:44.881366Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"89b5d45c-5447-477d-95b1-7555178da447","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:70edefe504ce0d5db1fd7b0980575dfa2410085e0d851a83ec47d5c8bdd1db71","observation_id":"0103b1f2-4265-49e3-9049-1fbcd0bd3649","resolution":{"observed_at":"2026-05-11T03:13:44.892618Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"43faf824-9a99-486b-a0cb-cab1e97beaf1","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:6b5b4d9dec1924d09fe71a2166599ae87ccc4cc89fb74048d92f368524d18c27","observation_id":"e58d89a5-9b66-4889-ab7e-ea9fa7b0cbe2","resolution":{"observed_at":"2026-05-11T03:13:44.910779Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"2e1bdfbe-cbac-492f-b242-07f03d908543","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:71c421c42e60492020d6fb950aafffddd72bf07eea94daabe31f0c8e1adee103","observation_id":"d9b8f84b-446b-4b2d-a349-fa7d9a3ca827","resolution":{"observed_at":"2026-05-11T03:13:44.914478Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"5cf9d8fe-28ae-4081-9d45-15f18993c66e","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:36364afa171284a09a4f527390a907af9ea7c284515b96577e7359476a559248","observation_id":"b6212520-1ab0-4d7b-9ba1-66f0b61e8eb6","resolution":{"observed_at":"2026-05-11T03:13:44.921640Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"de150663-8db8-410f-8fb3-7ea78fc6ee32","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:83ad4b726b3f97ebacf56e928df75cc287e68765bd5835ded961260fc02ba7bd","observation_id":"748848c5-baa8-44b7-b52f-d56ef75c34aa","resolution":{"observed_at":"2026-05-11T03:13:44.933664Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1adfa101-3b56-45c1-9939-56327357e914","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:298bdb55a8236d92af917dcb5a55988010038a6b87564c71ffb803675506abe9","observation_id":"50e11533-bdf1-4ec3-b911-782ab91dd1eb","resolution":{"observed_at":"2026-05-11T03:13:44.941167Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e4747908-1ba9-467b-a8a2-70910244e305","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:9431df5236b31e66b99f91f2d1dc302714e1a33f47f7726bd1929840fe356a84","observation_id":"22d9a70e-03dd-4639-8b3f-8701dcf6f88b","resolution":{"observed_at":"2026-05-11T03:13:44.951393Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f8bb143d-1690-4000-84ad-4a15e229b018","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:391b243d2d432301bbe767bc5544cdacbeaac88d2ce706bc950437697db8b02a","observation_id":"71e6d358-17ae-4508-aaa3-a4b128403cd4","resolution":{"observed_at":"2026-05-11T03:13:44.954728Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"731dde39-f8e8-4dd1-8873-9e242cc1189f","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:7bd7f8582d59d494a286e50696797a055ab2a2cec85090bc28e07bae93cadecd","observation_id":"daa4cd4a-f182-485f-a161-aee408f1987a","resolution":{"observed_at":"2026-05-11T03:13:44.957818Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"83af9b8e-1610-4013-806f-f34671caf1c7","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:a83b4f46f522549059dc62645b268ccbd89da243f25197e7f83b722dbe3e01ea","observation_id":"1498b710-f686-46f3-bdab-b6a5c1391955","resolution":{"observed_at":"2026-05-11T03:13:44.965347Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0080d6e2-8092-4ed0-94e0-fd4cecc810c4","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:9136677979d66004f5958a9d8f95e1b5870a85446d0ddb9c94724004ed4565b5","observation_id":"364d7348-b00d-4aa8-9f89-0af0185779be","resolution":{"observed_at":"2026-05-11T03:13:44.968921Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3ec46e8c-bd7c-4ba8-96a2-7b609eca4cf6","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:e79d8d47292a9eb01284f602c05c8e809271d3ef3bee5bdb9b344a2813134b46","observation_id":"1962ca6d-3eea-441e-83c8-14657d665178","resolution":{"observed_at":"2026-05-11T03:13:44.971958Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"47277fba-7733-4b5b-ba4a-bb207c1cae8c","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:733539ec05050bf2428d2f7b577885f3ef2b27f14a2b5272decf255cac0f47c5","observation_id":"f8680195-6a9c-4b4f-8131-6467e7a4a039","resolution":{"observed_at":"2026-05-11T03:13:44.978456Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"83f8345d-a155-4989-a416-a0d982d6a98f","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:a8a8ddfad9359c2abd154a3368258c6b806082ada8520ae73cc3246c11b1bc52","observation_id":"bb09a63d-0dd6-4567-a4b5-1d9efc500309","resolution":{"observed_at":"2026-05-11T03:13:44.986111Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"98a69dcf-8689-49ea-b983-caba34150ae5","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:dbdc2ec1ac7925e7c6b9d99bd4cfdee57fd861c0133c44b7a803478184ab3083","observation_id":"2a256fca-b4ed-4763-9549-95d37764c4a0","resolution":{"observed_at":"2026-05-11T03:13:44.996149Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"59be521c-103b-41a0-917a-6f7405bff3aa","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:6bea16f539ea54748eacbcc5969797635ad73ac39d4454e65b0ed558f4e95f87","observation_id":"fda8e43e-8070-4590-b235-5ad92f370471","resolution":{"observed_at":"2026-05-11T03:13:44.999266Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6e48f74a-e08c-4c34-979d-f8831caede37","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:e1f47b1fa25785da9dcd9b25a02a96ca39b4268f59fb7695fb457b215e1f026d","observation_id":"4c750cad-5844-4697-bf5d-56eaf08e8ab6","resolution":{"observed_at":"2026-05-11T03:13:45.004305Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"70bb58e9-d3e6-4450-953a-fcb5a7feb174","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:74acfad9ed2fb471bad93afd4d066518470c5f2bf299e85b7c03235ee0feec24","observation_id":"e964295d-8729-4aa2-bb90-3d189c8aa026","resolution":{"observed_at":"2026-05-11T03:13:45.012343Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"44c93a8b-a3ae-4602-ba8a-e15a8c0a8c34","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:3a36576e54ffe764c59121265e8627c301cf41f872ee2242ff1f141b2ab49901","observation_id":"0d2b9781-127c-4b9e-abba-3c090317aacb","resolution":{"observed_at":"2026-05-11T03:13:45.018555Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1bf59942-6ffb-4ef1-bb76-24468aa84112","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:f8a60da59d55261846c36203e5bed3818892263d03c224c6d171e6db4cc300a6","observation_id":"da79b985-4c92-4110-b1a8-2a18a76329f5","resolution":{"observed_at":"2026-05-11T03:13:45.021143Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"427fb3f7-f086-4e04-8b83-dd7b3f0b3c07","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:84ee74e280347422e14a26ca8a25474447da3a0569bc2ebed42574816fcbaa59","observation_id":"71c5d692-e8fa-4e6d-9980-d3d34864864f","resolution":{"observed_at":"2026-05-11T03:13:45.023742Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"f633d0ed-6701-44c7-a3de-bccc725c4646","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:70f1933047fe4d257b50ddc90ee85a3f87126ee7fa2df15dea71b747ec95a625","observation_id":"76827f1e-dcab-4ca9-9d19-c9170cafe735","resolution":{"observed_at":"2026-05-11T03:13:45.027883Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"042e0cd2-4593-48ab-9dee-c6d8a69c688d","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:723650884ce37d8b510ff5b2b0a01ee72006e12c19e78aa15c08728a60559e7f","observation_id":"7873b1f8-a11d-4c65-a1d4-7c5a517db945","resolution":{"observed_at":"2026-05-11T03:13:45.033115Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0393d56e-2aa9-401b-8181-e2cc7eaf4b91","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:39d28d282bf3b869adf0bd6767e0dae90afbcf3378a1d5d7e01ed5ddb0dd58d9","observation_id":"4f0b6370-201d-4367-8205-88ff32a8d54b","resolution":{"observed_at":"2026-05-11T03:13:45.040338Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1025953c-92be-4411-a619-169461278fad","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:e48a36c64fd3f8301392751eff4848867f9ae664bf5d2484b242c599609d50f4","observation_id":"e9dc2510-0eba-484b-91cd-9bb6a412f977","resolution":{"observed_at":"2026-05-11T03:13:45.043204Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"0d2aee40-7c0e-4b1b-8487-d7675e936618","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:0aaccb28f8e0a36e65115d30617ee9456327c6c62319b653a33d1529c8fc38fc","observation_id":"b98a88c8-fb5c-45e1-8dbb-5a24f4a90a30","resolution":{"observed_at":"2026-05-11T03:13:45.046098Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"4923eaf5-9b28-440f-bf60-ce6e19e4d3e3","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:96905cfaff44864261b2643fe35a403929f11e8bdf46bc1ad66975e7494983b6","observation_id":"5cefe4ad-7b0e-4f06-8a54-b44099d24ee3","resolution":{"observed_at":"2026-05-11T03:13:45.052252Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"78e8c790-52bc-4bd1-940c-0ff9762f4c5e","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:a5c18f7b2e950e0248584ae777def923a75155c372319bedc48262239caaa66c","observation_id":"6e285e2a-161e-434a-b21e-d477387fb42f","resolution":{"observed_at":"2026-05-11T03:13:45.055850Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"7051a3d6-c32e-4e7f-8e5d-22081e7a63f5","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:0cf9ebda1fe8baf5e9514515c121baa32d58fcede3d0a5bc8f1661f34dea6e5c","observation_id":"0ca286be-3dfe-4435-9c48-cf2b04c78095","resolution":{"observed_at":"2026-05-11T03:13:45.062326Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e407e335-61d2-4c24-8124-743ffdd0d972","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:89c7af9ec286f3f6c124889a3f2c787cfef4e1740776cc54901d9f30b7239bc9","observation_id":"ec2ed798-c280-444a-9e2d-3913c7143767","resolution":{"observed_at":"2026-05-11T03:13:45.065393Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"c2e871c7-cd9a-4443-8220-28f76c5282c0","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:d20b1fe91bc7f639894610eb07cb8261f4e508d7c9124099cddcfef1423f7c4c","observation_id":"a67120a8-7e7a-4dd2-87cd-677574db2f2a","resolution":{"observed_at":"2026-05-11T03:13:45.068238Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"847dd1e5-8bdd-4c42-ae71-d8fd41e0be37","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:1920f0a06f0467dfe6734207b8758b82b419cc4cdc370e47b104c02bb01cef34","observation_id":"6e2108f4-1677-4a02-bec5-8c43cb90362c","resolution":{"observed_at":"2026-05-11T03:13:45.074889Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"879a4320-4e82-4fed-9e1e-47058ee4fa3f","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:3c1464b5790f091912cf26792c57240a6a59253df9e159f3226b98e12da46180","observation_id":"8525c1bb-b90c-4b52-a24b-529807f3c449","resolution":{"observed_at":"2026-05-11T03:13:45.081686Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"e553074c-a53b-47cd-8041-33ec3392362f","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:7b6187f27cced626ed6b2979272a540d0a8dde9bdf4bb287c5d90b49500bdfbc","observation_id":"2a463c78-0580-497c-97bc-02cd47186542","resolution":{"observed_at":"2026-05-11T03:13:45.085113Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"162c6eee-68e7-4f37-8cd3-35401ce658ed","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:564667d1d2707c3b06df9da99af1b1a543fbbf27e2c9d52d37dc7d660718983f","observation_id":"9845a7d5-1ff5-4f27-a6af-c34f9aa36fb3","resolution":{"observed_at":"2026-05-11T03:13:45.088359Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ec9bbf98-7ff5-4785-a700-17ae7a5e2b9a","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:af0c1e10c7189b0c1c2a13d255101152816e57c04b06016e6a410bade4b1bac9","observation_id":"97fb3bec-c521-4c09-a05f-67d1f2e7e782","resolution":{"observed_at":"2026-05-11T03:13:45.091424Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b3ce4f8d-f091-4411-9999-994f1f289901","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:176dfa8c3529e8a1d72722bf6bf9db4a0b78357f755e69b69a4e25d69ef61861","observation_id":"7f450dbe-106e-443e-888b-f25221edbbf0","resolution":{"observed_at":"2026-05-11T03:13:45.101777Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"ff46f079-5273-40ff-8ded-e8600835ba55","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:f9b9afa09ac2ff315905e29ae9661a20f46e43bd4ada7ef1100bfef4c854a84d","observation_id":"c2714016-fa69-46fd-ad9e-47c689db7f3e","resolution":{"observed_at":"2026-05-11T03:13:45.105946Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"56033896-6b1b-44fb-92e1-5b7fff6f3e8e","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:d02817ecd74d70fcb0daae7f681027eb4cbda2e6ee0ab618ad6438576f8afcf8","observation_id":"296160fc-a014-4ac3-9a27-e2a2804c162f","resolution":{"observed_at":"2026-05-11T03:13:45.109142Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"671d2663-9ce3-4837-896d-f049f9fc6e4c","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:b7a714e5c6cebe3a8bdc3850c55bbf5700cdfb9e33bbe5d56bfcb4fe82f2be36","observation_id":"ce3e4746-8f89-40a4-af87-64d7fff0ce51","resolution":{"observed_at":"2026-05-11T03:13:45.114180Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"74460763-adc4-46d0-8916-7154576e574b","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:2bf5a94b592f2be721835ced7a4922639fae2ae155d88d6ad07351befce09caa","observation_id":"dbe33e9f-9a81-47b0-9bc8-59f06e23b5b7","resolution":{"observed_at":"2026-05-11T03:13:45.117427Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"3ce0e6c8-2dcc-421d-a1e8-18abcecc5233","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:8c02c73eda467a08d92f7cfdafe1221343fcda705928e548fe83dbc8fc2b3b85","observation_id":"003a263c-e6ef-4d63-8cc0-ebfb18c67d58","resolution":{"observed_at":"2026-05-11T03:13:45.127103Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"fe2c0ade-8e83-46a3-9b76-5f6954ad0c6c","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:25a3f48ec0464c7cf7d521a5d2fdc29eff27795fa7a89f416d6fd027df16fc3f","observation_id":"1eba5f2c-ee18-40b7-8d4c-87e576f270ff","resolution":{"observed_at":"2026-05-11T03:13:45.130189Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8bc10d78-ad84-4b02-b3b5-3ed7d4b26e47","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:d1a64618ccdf2c7304123fa3d04740020d89139a26c3f99f9015424e59f8164d","observation_id":"9be1482c-4da9-4508-b6fb-0975c84a327f","resolution":{"observed_at":"2026-05-11T03:13:45.133055Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"6827bb9f-a4bb-49af-84be-d233f727eb84","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:620ed92cd10d31b0628e59a8794ea87767e41dbb6b4d250ae65383e1a7fc4143","observation_id":"c40c9e23-cbdc-4e4a-be44-db40cc6c8783","resolution":{"observed_at":"2026-05-11T03:13:45.138634Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"9d5f6f03-57ae-43ce-bab0-c550e05e31c5","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:5849ce52074d454decaf9fb2f590c02b8b0f582b6edb7f2cbeece95c2479fd42","observation_id":"7072b557-03f3-420a-bf60-10339e71d9db","resolution":{"observed_at":"2026-05-11T03:13:45.141615Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"de37769d-3b7c-465c-a6eb-4d834c6886c7","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":96,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:c57ab5d040dff11e6cf6c8b4a3e4e9300079bfb761832466de54a440d54dfae6","observation_id":"d91e280e-4f5b-40e5-bf59-1de70f54e067","resolution":{"observed_at":"2026-05-11T03:13:45.144508Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"1bc89c79-cb39-4a5b-9678-017d265ad811","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":97,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:e268fed6a68424a378918757673be70e63dd81c672506bf49447c8cefa590c35","observation_id":"9770c3f2-c3dd-4b3e-b27f-aa91f80268fe","resolution":{"observed_at":"2026-05-11T03:13:45.147456Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"8dfabdb6-feb5-4da7-bfcd-2d514de60c63","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":98,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:8388e1b8f9777e4c1e4ed40f7857d00c204f1aa66959cc19f923ff203dde86fc","observation_id":"595f5a90-50b2-4062-936f-0da278f1e192","resolution":{"observed_at":"2026-05-11T03:13:45.153173Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"67a16631-4a45-4295-a06e-1704c97f484d","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":99,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:a9f48f966ca40ac893febee30deb67c30ddd890f00d22e68135d04430955dfb6","observation_id":"d2862316-b25a-4fe7-80f7-0cc98b62d382","resolution":{"observed_at":"2026-05-11T03:13:45.156511Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"df7cd3e8-3e41-471f-9ae8-1d1a150b6bc1","year":null},"citing_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"reference_index":100,"source":"pdf_text","source_observed_at":"2026-05-11T03:13:44.414237Z"},"links":{"citing_paper":"/paper/1705.06950"},"observation_digest":"sha256:66e6320f6a03a6a09bdf1296c8eaa99d8201067f4fc22565d49d3494691579fb","observation_id":"b2cc4c68-46a1-4b73-86a6-1f881e9ba89a","resolution":{"observed_at":"2026-05-11T03:13:45.159230Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset"},"reference_resolution":{"displayed":100,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":57,"unresolved":23,"verified_exact":4,"verified_fuzzy":16},"total_outbound_references":220},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 100 of 220 outbound references and 100 inbound Pith citation observations for arXiv:1705.06950."}