{"as_of":"2026-08-07T20:57:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ae9b75876c9727bed82bbc098c58b95f41763ccbb66fce1fb75a7279e6000805","coverage":[{"denominator":36,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":36,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T04:54:27.043439Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.09345/citation-record","integrity":"/paper/2506.09345/integrity","json":"/paper/2506.09345/citation-record.json","paper":"/paper/2506.09345"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:31.703243Z","title":"In: APSIPA ASC","venue":null,"work_id":"2370e0a5-1ba6-42a3-8490-c5eaa3d60ea0","year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:23.871963Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:26144ef7f421de83d42f24fb1c728a235a27ffe7bf39174ca4e18e6529aca005","observation_id":"4fe14c29-b171-48f0-b0d1-16568d4ac50f","resolution":{"observed_at":"2026-08-07T04:54:31.759941Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.039714Z","title":"In: ICCV","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.039714Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:856d940266dd3cb1f5c8bf76aa5f282674ba34bee3103f51b972f0488d15c850","observation_id":"1a61c004-ac5c-4fad-9a1f-a26918833a93","resolution":{"observed_at":"2026-08-07T04:54:24.039714Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:31.557156Z","title":"Multimedia Tools and Applications78(5), 5919–5939 (2019)","venue":null,"work_id":"d39dc00e-40fc-4c85-96b2-b0d230d88693","year":2019},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.199195Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:d8f162d92d20a87e4fc4f1970fbafebdb1b913de70280a8b31781fb4e09cfef6","observation_id":"b57db0ac-b687-4ca3-9c2d-96a8a09f55b9","resolution":{"observed_at":"2026-08-07T04:54:31.604939Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.346148Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.346148Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:ef551edc0dfae7751e185f4bc94c86bec72737b03d303cbb972a1848dae0fbfa","observation_id":"82c3c276-8576-4b13-86d0-a6c9e3da55f9","resolution":{"observed_at":"2026-08-07T04:54:24.346148Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:31.347265Z","title":"In: CVPR","venue":null,"work_id":"2cf2344c-c903-422b-b8ef-60f3ea2e4d65","year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.446296Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:16f07a751abc799d14d4a90816447ef114539fce9db114a06ee751c97f23c752","observation_id":"69d3dc0b-2477-4ec4-a651-45c794dc8903","resolution":{"observed_at":"2026-08-07T04:54:31.446583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:31.147550Z","title":"Multimedia Tools and Applications76, 4405–4425 (2017)","venue":null,"work_id":"e25f4522-d22f-41b7-a947-de2da7570d03","year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.496081Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:18f29aa6f3b46b56e7b19865ad299002df04b4e1335907db6b3698335a0b4351","observation_id":"bde8ed8f-195c-4150-9ee7-79acd655a524","resolution":{"observed_at":"2026-08-07T04:54:31.244149Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:30.939368Z","title":"IEEE Access10, 104190–104201 (2022)","venue":null,"work_id":"fd3c9cff-517a-4a72-9c97-a854c04629f2","year":2022},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.595282Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:4aee30cbd03b70bdbfe611a056da60c50c6e15988dba1dd179ef1c4e75053373","observation_id":"0dbe5243-bedb-40a5-8994-34d51d8cd441","resolution":{"observed_at":"2026-08-07T04:54:31.055072Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.666331Z","title":"In: CVPR (2009)","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.666331Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:b9acfc9b03eb3372017e00633de326487617ef550b20bf3fd425f11787a0894c","observation_id":"eaaf3268-cda9-4c74-a14c-2595284b78aa","resolution":{"observed_at":"2026-08-07T04:54:24.666331Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.733977Z","title":"In: ICCV","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.733977Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:2be6517b54e940f37dae772a4f1d973ee9b77de602dc3f90c6b2997619d30c8f","observation_id":"22b4ce7f-335a-42a0-901f-4c3779c7c23c","resolution":{"observed_at":"2026-08-07T04:54:24.733977Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.816336Z","title":"something something","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.816336Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:77c59a117b757c1f2a41469dc46fbb1c6a3714a9de52f650e78848042ba3962e","observation_id":"3082a3fa-579c-4d56-837c-f45f40d6e0ea","resolution":{"observed_at":"2026-08-07T04:54:24.816336Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:24.908790Z","title":"In: CVPR","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.908790Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:d9d0f16fd1a800deb89e7e95f1d02e15e7fdc0eae4015f5802c8024bcd60ecc4","observation_id":"c637523f-2e7f-424a-9e90-e18e4d9ae004","resolution":{"observed_at":"2026-08-07T04:54:24.908790Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1704.04861","last_updated":"2017-04-17T03:57:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-04-17T03:57:34Z","title":"MobileNets: Efficient Convolutional Neural Networks for Mobile Vision Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1704.04861","snapshot_observed_at":"2026-08-07T04:54:24.982062Z","title":"arXiv preprint arXiv:1704.04861 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:24.982062Z"},"links":{"cited_paper":"/paper/1704.04861","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:6bbdd13e43b136cceb041c3f643e5e42e7ba0545622c134100c16a710fe54bc9","observation_id":"9e37068c-72a1-4e57-b4bf-d3515bdd28ed","resolution":{"observed_at":"2026-08-07T04:54:24.982062Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1803.05407","last_updated":"2019-02-25T14:18:11Z","snapshot_observed_at":"2026-07-31T19:09:21.589864Z","submitted_at":"2018-03-14T17:09:27Z","title":"Averaging Weights Leads to Wider Optima and Better Generalization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1803.05407","snapshot_observed_at":"2026-08-07T04:54:25.055016Z","title":"arXiv preprint arXiv:1803.05407 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.055016Z"},"links":{"cited_paper":"/paper/1803.05407","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:b6ccfa11184c28346a1ef1dadb76c49904420b36da02bd9dd71177dd3d396615","observation_id":"873f5fc0-4b4b-487a-a8a5-d93ba12470bc","resolution":{"observed_at":"2026-08-07T04:54:25.055016Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:30.746574Z","title":null,"venue":null,"work_id":"7ec16d0f-18c7-486d-b4be-6677ec3aa80c","year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.106019Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:fa7b86acbc3e07b345be1d94b3a1c7b307f4470d593b666aca56a375c520a46e","observation_id":"badcc80c-c2a7-43b1-a17b-11ec095f566f","resolution":{"observed_at":"2026-08-07T04:54:30.811448Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-07-06T05:43:22.028213Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T04:54:25.206721Z","title":"arXiv preprint arXiv:1705.06950 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.206721Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:0bddce48379c174df0f0a06172a5b3b654d5840671a8195f86ce0bf3737b65fe","observation_id":"13db4fce-59e6-42a7-8ac1-851c85ea78b3","resolution":{"observed_at":"2026-08-07T04:54:25.206721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:30.553654Z","title":"In: ICCV","venue":null,"work_id":"0271c2f6-4fd5-4317-973d-fe0d80e8cbd4","year":2019},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.311624Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:2a6cb033c1ab403fe7b01b6f845225ac754e3adb2a792fb2ffdae558293e8a42","observation_id":"e207bfd6-5db2-4ab9-9b16-b870150c2458","resolution":{"observed_at":"2026-08-07T04:54:30.641980Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:30.353207Z","title":"In: MICCAI Challenge on Fast and Low-Resource Semi-supervised Abdominal Organ Segmentation, pp","venue":null,"work_id":"6bf24cc9-35c4-418b-b313-cb24e3cf2714","year":2023},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.399559Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:78d061c9ce1afba924c27acaa523994cf5adb22e2c3a1f3cfc239c1bd8c47aa3","observation_id":"4681c983-a592-4baa-9117-33c64a77256b","resolution":{"observed_at":"2026-08-07T04:54:30.447986Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:30.156739Z","title":"IJCV118, 217–239 (2016)","venue":null,"work_id":"c7c20cd3-d3b2-490d-b0a7-d58ce1b641a0","year":2016},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.468009Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:394a2f21c660fbeeed2d792c5a16ebaa50264bf44be1e08ec5cb97507d1a3ca6","observation_id":"93bfa269-5f4f-47c9-8d27-247edc150b2e","resolution":{"observed_at":"2026-08-07T04:54:30.264906Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.991162Z","title":"NIPS27(2014)","venue":null,"work_id":"579e6212-7a0c-4332-b3da-12cfa7151a96","year":2014},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.561044Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:d40d9fa4078d6e93e8197004e97e684aafe0cbdfb4581ae69cdaab160278f464","observation_id":"ad7b5a69-5544-4163-9911-0a19bbfb3936","resolution":{"observed_at":"2026-08-07T04:54:30.069230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.819313Z","title":"In: ICME","venue":null,"work_id":"651aff93-83bb-409b-ad14-64c34df8e51c","year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.662260Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:d4af47f61cd4d3161933621e16dcbc061559a8606849d18493c0468c036d4909","observation_id":"da6ba0d6-bb6e-4172-ac97-ae0546d47fb4","resolution":{"observed_at":"2026-08-07T04:54:29.893835Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.630306Z","title":"TPAMI45(3), 3200–3225 (2022)","venue":null,"work_id":"6b06933e-e4ad-4884-a853-428ea17e9a8a","year":2022},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.743831Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:db1f3748c6fb945cbf361dcbfbe93e659e1df6bd9af909fd83d1aeaf908d2315","observation_id":"69632de9-57e4-4ade-bcaa-17465aeac7e7","resolution":{"observed_at":"2026-08-07T04:54:29.732371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.446240Z","title":"In: CVPR","venue":null,"work_id":"7a037e9b-6699-4564-9be5-6c846b2e2e2a","year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.847532Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:05bdc1d07948d607f9a34387325a8fbc1acc062efafdb053b9fb42eba4866cc1","observation_id":"0cdcc82b-a5da-4da4-a988-9519da0dd83a","resolution":{"observed_at":"2026-08-07T04:54:29.537036Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.278770Z","title":"In: ICMEW","venue":null,"work_id":"d9d4bf86-3acb-4895-9bc2-5b25c21c07b4","year":2024},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.914545Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:228d53e49b132278bebbf7be2dcd192465c2b52c25929dcfad9fcf3bcb551f32","observation_id":"13a193a2-97c5-4f59-b854-620a38035930","resolution":{"observed_at":"2026-08-07T04:54:29.350965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:29.116206Z","title":"IEEE Access11, 53880–53898 (2023) An Effective End-to-End Solution for Multimodal Action Recognition 15","venue":null,"work_id":"1227e6a9-a638-4cef-b1fd-e227aea7b441","year":2023},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:25.980290Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:aa00228aef633c46f0891fc34ee99f0cb76b67569f00843b2250b8cf0696b297","observation_id":"9e37f9f4-5f0d-43f0-b97e-9edcd578d29f","resolution":{"observed_at":"2026-08-07T04:54:29.193124Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.928228Z","title":"In: ECCV","venue":null,"work_id":"7d4c8169-77d3-4415-829d-c149f4d5cecf","year":2016},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.059553Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:9b40e6b80cc04e8c525c745fe5b2f8800e114e746a0e4b32043a02d364a30d87","observation_id":"19f1807b-06ea-494d-b2fd-6664e96a985a","resolution":{"observed_at":"2026-08-07T04:54:29.001583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.14921","last_updated":"2025-04-23T13:22:33Z","snapshot_observed_at":"2026-07-06T21:12:23.428174Z","submitted_at":"2025-04-21T07:40:35Z","title":"Fast Adversarial Training with Weak-to-Strong Spatial-Temporal Consistency in the Frequency Domain on Videos","version":2},"cited_work":{"arxiv_id":"2504.14921","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.14921","snapshot_observed_at":"2026-08-07T04:54:27.760088Z","title":"Fast Adversarial Training with Weak-to-Strong Spatial-Temporal Consistency in the Frequency Domain on Videos","venue":"cs.CV","work_id":"1ad4b7ca-d92c-4855-a6ef-774e1db6a687","year":2025},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.160531Z"},"links":{"cited_paper":"/paper/2504.14921","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:b5fa34f432337a91b062f000b328d5cf05650ba3f4e3d9e8941ace644f3739ec","observation_id":"819dd40b-0048-4e1b-bdfd-d3215bb5c135","resolution":{"observed_at":"2026-08-07T04:54:27.915070Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.768615Z","title":"In: 2024 IEEE International Conference on Multimedia and Expo (ICME)","venue":null,"work_id":"d455b431-0a28-4768-97e7-9f6416808097","year":2024},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.223903Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:2b3c2c45cf80a5898f2ff10d2c5e3262b39dd066eb293534c22285ab2f268958","observation_id":"9a512df5-362e-4ab6-ab00-7ebcc5c493be","resolution":{"observed_at":"2026-08-07T04:54:28.847086Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2504.12129","last_updated":"2025-04-23T13:23:07Z","snapshot_observed_at":"2026-07-06T21:10:22.737231Z","submitted_at":"2025-04-16T14:44:00Z","title":"Anti-Aesthetics: Protecting Facial Privacy against Customized Text-to-Image Synthesis","version":2},"cited_work":{"arxiv_id":"2504.12129","doi":null,"metadata_source":"pith","pith_arxiv_id":"2504.12129","snapshot_observed_at":"2026-08-07T04:54:27.587320Z","title":"Anti-Aesthetics: Protecting Facial Privacy against Customized Text-to-Image Synthesis","venue":"cs.CV","work_id":"8793b2fc-8b34-4120-8f3c-b80779a11a0f","year":2025},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.336250Z"},"links":{"cited_paper":"/paper/2504.12129","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:d0d372b246a2c04c889504fa4ccf899b6fb165acc02dff6fb8707337fce5ad56","observation_id":"5595516f-0638-4721-8c25-350ac0ba2189","resolution":{"observed_at":"2026-08-07T04:54:27.664544Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.590661Z","title":"In: International Conference on Pattern Recogni- tion","venue":null,"work_id":"aa1fea56-6667-4b7a-b71b-6973616e2cd9","year":2025},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.434695Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:408657d863cecdde7f86cd4f287fe6e4d648fba8aeeb86e5d5caf5a529e97721","observation_id":"635748f3-d044-4b65-802a-1eb7ee39af49","resolution":{"observed_at":"2026-08-07T04:54:28.646648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.06276","last_updated":"2025-04-23T13:22:55Z","snapshot_observed_at":"2026-07-06T20:49:09.368757Z","submitted_at":"2025-03-08T16:48:05Z","title":"Exploring Adversarial Transferability between Kolmogorov-arnold Networks","version":2},"cited_work":{"arxiv_id":"2503.06276","doi":null,"metadata_source":"pith","pith_arxiv_id":"2503.06276","snapshot_observed_at":"2026-08-07T04:54:27.398699Z","title":"Exploring Adversarial Transferability between Kolmogorov-arnold Networks","venue":"cs.CV","work_id":"110b15f7-eb1f-40df-b1c8-feb1d31d315f","year":2025},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.537712Z"},"links":{"cited_paper":"/paper/2503.06276","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:48ba4fdd1355fc7b7c5dcc0c0798a5a60e0edc5ed585dd34e16ace630e18daa5","observation_id":"3a460653-485c-4ccd-a95c-dbe3313037ee","resolution":{"observed_at":"2026-08-07T04:54:27.490087Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:26.630591Z","title":"In: CVPR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.630591Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:e6f38b3d239cf013731ee4b215dbd541fa5ad4f6d251b36b500a6d9527321d83","observation_id":"3f373856-cdb2-4ecc-94e6-88005e1a88be","resolution":{"observed_at":"2026-08-07T04:54:26.630591Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.385771Z","title":"IEEE Transactions on Pattern Analysis and Machine Intelligence45(9), 10898–10912 (2023)","venue":null,"work_id":"603d8a67-9f13-407e-b071-7f58017d6dd7","year":2023},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.744900Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:aaf63d5fe627009b25f141b2a63daa6c84761ae5bd66de6786ff472aa8a3ff49","observation_id":"5fc7628d-713a-48a3-8ddf-4f69b39ee8cb","resolution":{"observed_at":"2026-08-07T04:54:28.484481Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.232783Z","title":"In: ECCV","venue":null,"work_id":"4f3b2c33-08d7-4544-a02d-baeef69c3a1a","year":2018},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.808139Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:4a290f33f949ceb1d2a574c74802ddfcb2eb133129c7c5a12b81c0dd19356830","observation_id":"0a9f75b2-1cad-40ce-9211-228bb2790f83","resolution":{"observed_at":"2026-08-07T04:54:28.318373Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.00896","last_updated":"2023-03-27T01:57:56Z","snapshot_observed_at":"2026-07-06T14:36:53.521643Z","submitted_at":"2023-01-03T00:28:57Z","title":"Efficient Robustness Assessment via Adversarial Spatial-Temporal Focus on Videos","version":2},"cited_work":{"arxiv_id":"2301.00896","doi":null,"metadata_source":"pith","pith_arxiv_id":"2301.00896","snapshot_observed_at":"2026-08-07T04:54:27.195087Z","title":"Efficient Robustness Assessment via Adversarial Spatial-Temporal Focus on Videos","venue":"cs.CV","work_id":"b1224f83-969d-4d56-bd0e-d775c08b9853","year":2023},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.879331Z"},"links":{"cited_paper":"/paper/2301.00896","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:9c08c9878abc91a98b773b004e1846e481684349b8501e246831cd964e2c953b","observation_id":"c7f35bfb-411d-4dbf-aaad-59f1b9dbc9db","resolution":{"observed_at":"2026-08-07T04:54:27.303619Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1910.04867","last_updated":"2020-02-21T13:36:15Z","snapshot_observed_at":"2026-08-03T18:52:32.049047Z","submitted_at":"2019-10-01T17:06:29Z","title":"A Large-scale Study of Representation Learning with the Visual Task Adaptation Benchmark","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.04867","snapshot_observed_at":"2026-08-07T04:54:26.953389Z","title":"arXiv preprint arXiv:1910.04867 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:26.953389Z"},"links":{"cited_paper":"/paper/1910.04867","citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:aa61c3688be8ce9d757e244c5abea165b50833d3687f12a957adeb8a0b733584","observation_id":"b3764f9d-060d-49ab-96b2-57ffe4888b84","resolution":{"observed_at":"2026-08-07T04:54:26.953389Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T04:54:28.069648Z","title":"TOMM 18(3), 1–24 (2022)","venue":null,"work_id":"f628bf04-42da-4579-8e07-b1344f2b2dd2","year":2022},"citing_paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T04:54:27.043439Z"},"links":{"citing_paper":"/paper/2506.09345"},"observation_digest":"sha256:511296ec3f78e77407d5503b1c73bac80cf2ae3dca3b85dba3c4780c140f8737","observation_id":"21e3699c-b928-43e3-843b-2ef8ebe4225f","resolution":{"observed_at":"2026-08-07T04:54:28.140159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.09345","last_updated":"2025-06-11T02:54:02Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T04:48:02.733774Z","submitted_at":"2025-06-11T02:54:02Z","title":"An Effective End-to-End Solution for Multimodal Action Recognition"},"reference_resolution":{"displayed":36,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":12,"verified_exact":0,"verified_fuzzy":20},"total_outbound_references":36},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 36 of 36 outbound references and 0 inbound Pith citation observations for arXiv:2506.09345."}