{"as_of":"2026-08-08T08:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:12c41e591348ea7bc1e7ee46d9c8994cdb987da72864c636aa01a4ffcab9596d","coverage":[{"denominator":51,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":51,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:09:34.940377Z","state":"measured"},{"denominator":51,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":51,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2505.19928/citation-record","integrity":"/paper/2505.19928/integrity","json":"/paper/2505.19928/citation-record.json","paper":"/paper/2505.19928"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:29.486716Z","title":"In: ICCV","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:29.486716Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:b33661a947d37fc6b1503713171e61d1577003592a081c255536c8b930e3dc50","observation_id":"fbfb0680-d337-4d8c-a653-2412c604fd64","resolution":{"observed_at":"2026-08-07T14:09:29.486716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1607.06450","last_updated":"2016-07-21T19:57:52Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2016-07-21T19:57:52Z","title":"Layer Normalization","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1607.06450","snapshot_observed_at":"2026-08-07T14:09:29.591855Z","title":"arXiv preprint arXiv:1607.06450 (2016)","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:29.591855Z"},"links":{"cited_paper":"/paper/1607.06450","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:a42d41dd7817e0034ba1d4f5e23c70466212e333ad411b197fb853a0db60117f","observation_id":"46e61675-bd29-4164-88ad-85c03a4d01f1","resolution":{"observed_at":"2026-08-07T14:09:29.591855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.899389Z","title":"In: International Conference of the Italian Association for Artificial Intelligence","venue":null,"work_id":"e8aa95be-36e5-4cfe-8f19-257e7831334a","year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:29.714277Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:02e0892f3e695b1dab3e6dc04d58be6d4e34b99b1bc63fe2cfbafcf92d6631e4","observation_id":"5021c6c2-4c4b-4725-bff2-b36ac5cb3465","resolution":{"observed_at":"2026-08-07T14:09:39.981875Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.678957Z","title":"NeurIPS32(2019)","venue":null,"work_id":"3d445577-ad0c-452b-b2cd-0e46dc1fc0a5","year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:29.822556Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:8dcd5ad6e6a4d04a009dd8e8bea4600cbd7382f3db3267432616176782548221","observation_id":"313f5eca-e0c5-4f48-a4df-572a29498f12","resolution":{"observed_at":"2026-08-07T14:09:39.738286Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:29.956535Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:29.956535Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:cbc12124325f8625c86ab8c163b45fae2c8924a65558fe66c4491a329eec28a4","observation_id":"0ccb2e92-d69b-4a3a-9ca3-35cdf9e29eab","resolution":{"observed_at":"2026-08-07T14:09:29.956535Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.509963Z","title":"In: ECCV","venue":null,"work_id":"5a2f1d65-3461-4743-a891-5eb0a501d330","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.045433Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:6ee4380951cef91d4e2c3a677cef35c818837abae4b201552dc58d13fc4ec6fd","observation_id":"9b1b3ff9-9f42-4703-b561-594184628560","resolution":{"observed_at":"2026-08-07T14:09:39.590269Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1904.10509","last_updated":"2019-04-23T19:29:47Z","snapshot_observed_at":"2026-08-06T08:05:35.311510Z","submitted_at":"2019-04-23T19:29:47Z","title":"Generating Long Sequences with Sparse Transformers","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.10509","snapshot_observed_at":"2026-08-07T14:09:30.098726Z","title":"arXiv preprint arXiv:1904.10509 (2019)","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.098726Z"},"links":{"cited_paper":"/paper/1904.10509","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:60a0dd8dccb3147674da9938e41eda6d0499431139e74195ee6bd7227571b5d6","observation_id":"9d9535ac-23cc-4b2b-89d4-c41582f8b8fa","resolution":{"observed_at":"2026-08-07T14:09:30.098726Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1805.06085","last_updated":"2018-07-17T07:33:19Z","snapshot_observed_at":"2026-07-06T06:39:21.688392Z","submitted_at":"2018-05-16T01:19:43Z","title":"PACT: Parameterized Clipping Activation for Quantized Neural Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1805.06085","snapshot_observed_at":"2026-08-07T14:09:30.185605Z","title":"arXiv preprint arXiv:1805.06085 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.185605Z"},"links":{"cited_paper":"/paper/1805.06085","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:789a52373130b0916ec49deb6ce7664c025fdfe4522b35c55b85564d79f67b3b","observation_id":"dadcf6e0-6de0-43e4-8915-9f58f187b798","resolution":{"observed_at":"2026-08-07T14:09:30.185605Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.14794","last_updated":"2022-11-19T12:45:21Z","snapshot_observed_at":"2026-08-07T11:26:24.987920Z","submitted_at":"2020-09-30T17:09:09Z","title":"Rethinking Attention with Performers","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.14794","snapshot_observed_at":"2026-08-07T14:09:30.367857Z","title":"arXiv preprint arXiv:2009.14794 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.367857Z"},"links":{"cited_paper":"/paper/2009.14794","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:add3f2ca9e4dc920b3faf73ff5e830691cacf0e31c4b5686e670ebbd70530298","observation_id":"8e33402d-1f62-4f5e-9a4c-22682da0a8ee","resolution":{"observed_at":"2026-08-07T14:09:30.367857Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.375579Z","title":"In: 2019 IEEE/CVF International Conference on Computer Vision Workshop (ICCVW)","venue":null,"work_id":"56029e9c-6635-4e86-b9e8-5e1458cfa605","year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.486301Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:3c5b6c5616a0657487fba77f35b8bba103d495d7a282815a9bf000730470b635","observation_id":"e9102f5b-254b-4d5a-aab5-fbdf9cdcd390","resolution":{"observed_at":"2026-08-07T14:09:39.419445Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.243515Z","title":"In: CVPR","venue":null,"work_id":"396c676f-e3b5-4d27-b046-88e3151f75bb","year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.561364Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:229ce0e0e85f0c5628c781f4e92b0d7d835432542269dfc7b08471ad132422c7","observation_id":"4fd76f17-f6be-41a4-a788-677b00b77253","resolution":{"observed_at":"2026-08-07T14:09:39.294769Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-07T14:09:30.647439Z","title":"arXiv preprint arXiv:2010.11929 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.647439Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:eba0603674dd56746d304a5f22fe1529dde7a66d7a2fabbacf881d225c821ede","observation_id":"8a0801bc-3660-47b2-816d-a8b42c7b7398","resolution":{"observed_at":"2026-08-07T14:09:30.647439Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.143143Z","title":"In: CVPR","venue":null,"work_id":"22d89eb9-7e12-4fd9-8de7-1f6f9a13d0ce","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.720520Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:4ae4386ed1fa207897e4d59531fb29bd1db115be2dc54c7e62ff84562d1a4497","observation_id":"674fa736-c0e3-4887-87fa-a916ab41bb9c","resolution":{"observed_at":"2026-08-07T14:09:39.185011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:39.015037Z","title":"In: CVPR","venue":null,"work_id":"cf5b2c30-2ed6-48be-9c20-858daf70c0d4","year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.880079Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:ecb1259bb2e21643a78d1bfc589cc4b020616d9258a9a587e542b3e02c072948","observation_id":"57d6d1ee-7792-4b1b-9c9b-ccb68b62bdef","resolution":{"observed_at":"2026-08-07T14:09:39.086274Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:30.970044Z","title":"In: ICCV","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:30.970044Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:72031fc9f38d62f5d8287d0d8236f99a1fd7eaed00dd89caaf7359bfabc6e490","observation_id":"c1e61fba-e00d-4c73-a6d2-bf26529f8e4c","resolution":{"observed_at":"2026-08-07T14:09:30.970044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2009.07485","last_updated":"2020-09-16T06:11:40Z","snapshot_observed_at":"2026-08-06T16:35:37.327006Z","submitted_at":"2020-09-16T06:11:40Z","title":"Pooling Methods in Deep Neural Networks, a Review","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2009.07485","snapshot_observed_at":"2026-08-07T14:09:31.094527Z","title":"arXiv preprint arXiv:2009.07485 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.094527Z"},"links":{"cited_paper":"/paper/2009.07485","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:7ed636f3d1a3e96d35eb2f160da2db27ab75e32de73d265387f6e0e4e30565d0","observation_id":"0debf233-c7b9-42bf-84a9-2cfa3d57848f","resolution":{"observed_at":"2026-08-07T14:09:31.094527Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:38.833123Z","title":"In: Low-Power Computer Vision, pp","venue":null,"work_id":"6ef29ace-217b-4a61-b6db-5694c3d62adb","year":2022},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.199256Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:046ab77977d9d11e47069dc0c482c5199dc39147428b847c21e6779209b187eb","observation_id":"c491822f-e885-437c-bf68-54234abc3221","resolution":{"observed_at":"2026-08-07T14:09:38.905878Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:31.347988Z","title":"In: CVPR","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.347988Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:9955d6a986d4b578a0d18a7cfff5af19cf7c479e8fc051f917e085e0ecaaaeec","observation_id":"b1cfde9c-9aa5-43ac-a224-d5d9f5a54b20","resolution":{"observed_at":"2026-08-07T14:09:31.347988Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:38.642017Z","title":"In: ECCV","venue":null,"work_id":"f8dbf5b8-c9c3-463c-8f6f-86de3ae2d696","year":2016},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.410098Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:b12c0d8d745250f6c947baab9ee8000fa5eb644556f45565c269b85c96b9ee54","observation_id":"c2961db8-5b11-4449-b511-afc1ea6fa3a1","resolution":{"observed_at":"2026-08-07T14:09:38.725043Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1502.03167","last_updated":"2015-03-02T20:44:12Z","snapshot_observed_at":"2026-07-06T04:08:54.419941Z","submitted_at":"2015-02-11T01:44:18Z","title":"Batch Normalization: Accelerating Deep Network Training by Reducing Internal Covariate Shift","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1502.03167","snapshot_observed_at":"2026-08-07T14:09:31.484057Z","title":"arXiv preprint arXiv:1502.03167 (2015) 16 G","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.484057Z"},"links":{"cited_paper":"/paper/1502.03167","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:3acf3777ec43f3fa54d70b17165b08654781bd22ffdd453db2180e88bfe1eb16","observation_id":"f34f88d3-5618-4011-99d1-6a41850ffc4a","resolution":{"observed_at":"2026-08-07T14:09:31.484057Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:38.538992Z","title":"In: CVPR","venue":null,"work_id":"b464ba11-4d98-4589-8656-ea1c1c94209b","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.565133Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:db06053838364a3812ddfe4bf7da297e843a2da8aea17570fb62ddc899d194f2","observation_id":"41dc9b39-7b51-4152-ba3a-fbfd2505c097","resolution":{"observed_at":"2026-08-07T14:09:38.587464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:38.402120Z","title":"IEEE TPAMI35(1), 221–231 (2012)","venue":null,"work_id":"2c806da1-0162-4d40-bef6-48c352e48008","year":2012},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.652388Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:ee9c47fd9d283fc0d8f91b4c4573ebafb5a3880bf4efea499baad169423e2818","observation_id":"ba1f5cca-f7ac-4ae8-a931-00575b1b0b4d","resolution":{"observed_at":"2026-08-07T14:09:38.474260Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:38.177127Z","title":"In: CVPR","venue":null,"work_id":"f35f003f-23df-4a6d-aa2c-1976f3564a4e","year":2014},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.741340Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:4f6e7ce94795e5d72826fe24e2dbdc5c4a9b3c72fa76a2cbf5eb51a9cbd6db1b","observation_id":"3b257bb1-d200-45e0-b619-e044d3c622ef","resolution":{"observed_at":"2026-08-07T14:09:38.305289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-07-06T05:43:22.028213Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-07T14:09:31.866045Z","title":"arXiv preprint arXiv:1705.06950 (2017)","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:31.866045Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:eb9ddc2000ae5d8d2f7f5723c515784282ee2ce74f93ed33a7bed58fd43dc075","observation_id":"4d403432-ecd7-42ff-a012-7cf19816face","resolution":{"observed_at":"2026-08-07T14:09:31.866045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1806.08342","last_updated":"2018-06-21T17:32:46Z","snapshot_observed_at":"2026-07-06T06:46:08.396066Z","submitted_at":"2018-06-21T17:32:46Z","title":"Quantizing deep convolutional networks for efficient inference: A whitepaper","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.08342","snapshot_observed_at":"2026-08-07T14:09:32.004751Z","title":"arXiv preprint arXiv:1806.08342 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.004751Z"},"links":{"cited_paper":"/paper/1806.08342","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:49e8bda9c7596b268c436308d652fe4c349adf95a94ea1feb6ff04ff47edc350","observation_id":"e67622fe-af36-44e9-acca-2cd4c12418bf","resolution":{"observed_at":"2026-08-07T14:09:32.004751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:37.951498Z","title":"In: ICCV","venue":null,"work_id":"26fc54d6-1e19-4b63-ab5c-6198404b66b3","year":2011},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.103386Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:8fc6d1ad7f309b19a20f99bd3c0702d1796d4b8633eb8bb0d0b3674f3488025f","observation_id":"8d205fd1-ace6-4fa0-8633-3b115a5c9c5c","resolution":{"observed_at":"2026-08-07T14:09:38.058347Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16235","last_updated":"2023-07-30T13:57:25Z","snapshot_observed_at":"2026-07-06T16:00:20.878025Z","submitted_at":"2023-07-30T13:57:25Z","title":"Spiking Neural Networks and Bio-Inspired Supervised Deep Learning: A Survey","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.16235","snapshot_observed_at":"2026-08-07T14:09:32.233122Z","title":"arXiv preprint arXiv:2307.16235 (2023)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.233122Z"},"links":{"cited_paper":"/paper/2307.16235","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:b703984385b628cb44a3f793805792b35ffa25c67d420244a9cd9718209a2b44","observation_id":"1ee15b79-b176-4761-892a-8458b2ceb590","resolution":{"observed_at":"2026-08-07T14:09:32.233122Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.16236","last_updated":"2023-07-30T13:58:46Z","snapshot_observed_at":"2026-08-05T06:04:57.052616Z","submitted_at":"2023-07-30T13:58:46Z","title":"Synaptic Plasticity Models and Bio-Inspired Unsupervised Deep Learning: A Survey","version":1},"cited_work":{"arxiv_id":"2307.16236","doi":null,"metadata_source":"pith","pith_arxiv_id":"2307.16236","snapshot_observed_at":"2026-08-07T14:09:35.095595Z","title":"Synaptic Plasticity Models and Bio-Inspired Unsupervised Deep Learning: A Survey","venue":"cs.NE","work_id":"30424bff-16e0-41e7-8afa-eb533065a490","year":2023},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.364738Z"},"links":{"cited_paper":"/paper/2307.16236","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:57c9db239bc9418e7616a677dc1dcf9f2db800dcd258952bd624e044d4edf95f","observation_id":"408de803-5924-4c9f-bd93-867c94aa970f","resolution":{"observed_at":"2026-08-07T14:09:35.175066Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2112.13492","last_updated":"2021-12-27T03:24:03Z","snapshot_observed_at":"2026-07-06T12:22:32.240903Z","submitted_at":"2021-12-27T03:24:03Z","title":"Vision Transformer for Small-Size Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2112.13492","snapshot_observed_at":"2026-08-07T14:09:32.434252Z","title":"arXiv preprint arXiv:2112.13492 (2021)","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.434252Z"},"links":{"cited_paper":"/paper/2112.13492","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:bc1ead78b1353ee5ca2e100286f45b6b37b5bb7094cb3f20f154e8b7a1769478","observation_id":"ec011436-9703-4faf-ae61-36b73a01b100","resolution":{"observed_at":"2026-08-07T14:09:32.434252Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2201.04676","last_updated":"2022-02-08T16:36:12Z","snapshot_observed_at":"2026-08-04T03:00:58.368363Z","submitted_at":"2022-01-12T20:02:32Z","title":"UniFormer: Unified Transformer for Efficient Spatiotemporal Representation Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2201.04676","snapshot_observed_at":"2026-08-07T14:09:32.515706Z","title":"arXiv preprint arXiv:2201.04676 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.515706Z"},"links":{"cited_paper":"/paper/2201.04676","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:2380bee7de2475070fca32b8ebab758bcf315857b62571facda8eff0e5ea9929","observation_id":"319d4dc1-ee5e-40b3-b5d9-8145604c571d","resolution":{"observed_at":"2026-08-07T14:09:32.515706Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2211.09552","last_updated":"2022-11-17T14:17:40Z","snapshot_observed_at":"2026-08-07T04:39:25.258902Z","submitted_at":"2022-11-17T14:17:40Z","title":"UniFormerV2: Spatiotemporal Learning by Arming Image ViTs with Video UniFormer","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2211.09552","snapshot_observed_at":"2026-08-07T14:09:32.639342Z","title":"arXiv preprint arXiv:2211.09552 (2022)","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.639342Z"},"links":{"cited_paper":"/paper/2211.09552","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:5d283f743fff6c07c5870e1f5a38ebe44a974729154633d452fc07b56e2434cd","observation_id":"f966cc04-5513-4b7b-ab90-7dd8676b441e","resolution":{"observed_at":"2026-08-07T14:09:32.639342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:32.726289Z","title":"In: ICCV","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.726289Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:896b6c2b434abbdbd4695ce3aafd3debef2d8decc7833ef1e2ba79ab877120db","observation_id":"a2c247c6-af02-4324-a410-5031ac757656","resolution":{"observed_at":"2026-08-07T14:09:32.726289Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:32.794477Z","title":"In: CVPR","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.794477Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:412fc63a52d10f3378f2f94234229b3944c0e79f1bf4891b3d505a949be4199f","observation_id":"a5f8f6c5-2844-405e-992f-b10bf23fe0af","resolution":{"observed_at":"2026-08-07T14:09:32.794477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:37.722783Z","title":"In: ICML (2010)","venue":null,"work_id":"c4abde2e-ef88-43d0-bb17-c7198f6ce47c","year":2010},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:32.916422Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:2ad3767e3ed13c97757c3615b45053eebad31831b46ce2a2c2e770a083d8291f","observation_id":"1c476740-b603-4863-8163-602ff0d4353c","resolution":{"observed_at":"2026-08-07T14:09:37.828535Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:37.411797Z","title":"In: WACV","venue":null,"work_id":"476f7d3e-f893-469b-9a05-a032caec4172","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.070620Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:5dad6af6d60597a66b5a57a9af2bd5614cd903c59be934bebb2910ca6444c142","observation_id":"4558631e-01b6-4a07-b23a-c0beddfa92d8","resolution":{"observed_at":"2026-08-07T14:09:37.589480Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:37.209512Z","title":"In: CVPR","venue":null,"work_id":"c7524be0-1c84-4b7a-9dd5-b30ef0587cf9","year":2023},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.214074Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:02180e1ce18ace6f69f42f7c664d8e11ddaad68a040a378493038a8bda5df5f8","observation_id":"8303b286-13d4-4627-af36-4c54535d790d","resolution":{"observed_at":"2026-08-07T14:09:37.287243Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2103.13915","last_updated":"2021-05-27T13:17:38Z","snapshot_observed_at":"2026-07-06T10:53:21.486703Z","submitted_at":"2021-03-25T15:25:17Z","title":"An Image is Worth 16x16 Words, What is a Video Worth?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2103.13915","snapshot_observed_at":"2026-08-07T14:09:33.385463Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.385463Z"},"links":{"cited_paper":"/paper/2103.13915","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:b55a08f15f9dbbf55681c031578b35a4597cad7213d64a56ba96d7e9fa85efbf","observation_id":"3a9d2793-0b66-4b17-8c98-6e4c3a5ce66a","resolution":{"observed_at":"2026-08-07T14:09:33.385463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:36.854976Z","title":"NeurIPS27(2014)","venue":null,"work_id":"c4c75ef2-00dc-4104-b403-4f0d1063f0a0","year":2014},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.521732Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:d89222daa09d8c79289d17f805bcb4396b6d806be42afcd189c9cc51aa156058","observation_id":"ab983d10-0b88-4ada-a17b-12853a5a2b18","resolution":{"observed_at":"2026-08-07T14:09:37.030499Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-07T14:09:33.630531Z","title":"arXiv preprint arXiv:1212.0402 (2012)","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.630531Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:7cb790fc6fa0db2498249c9e139758b05231acba157d603e4c045067f8d39b82","observation_id":"c10c3703-f51d-4476-862b-5a2f1bbda5ba","resolution":{"observed_at":"2026-08-07T14:09:33.630531Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:36.696597Z","title":"JMLR15(1), 1929–1958 (2014)","venue":null,"work_id":"4eea48b5-65e5-43e9-ac2a-9b170119e977","year":2014},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.739366Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:e759e526e62c2615b3e7e5662f5305ebb874db4aade7170b64569f0da6c9f66c","observation_id":"2aaa0ab8-352b-4a39-95c9-ff6d9f768bf0","resolution":{"observed_at":"2026-08-07T14:09:36.747133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:36.462119Z","title":"In: WACV","venue":null,"work_id":"a2fd4b9b-7292-4373-994f-e2b97456dd57","year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.852925Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:92eabacd7529d3d9655d369114b2b4a65a4b04ab4a839ddea98d4c9a5ffa8332","observation_id":"835575a3-b2be-4a26-8369-54aa7d524513","resolution":{"observed_at":"2026-08-07T14:09:36.571031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:36.260830Z","title":"In: CVPR","venue":null,"work_id":"bf14ba1a-d637-473e-9c21-487698066298","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:33.935324Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:6921db9c65d879347eefaad8cdb8e1d3093dc0161b0981dad9513030d36f02b5","observation_id":"c9f96cec-427b-4725-a600-8ed63be4c75b","resolution":{"observed_at":"2026-08-07T14:09:36.328356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:36.041474Z","title":"In: ICCV","venue":null,"work_id":"47b352af-2b56-4a4a-b5dc-e69ad224990e","year":2015},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.057210Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:215031f3de16495fd2efc5b457a0569e224847bc068e8489603aed79e059e2c9","observation_id":"7ec7fc2c-a4ec-4951-a17b-5e75c10954f8","resolution":{"observed_at":"2026-08-07T14:09:36.134016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:34.136609Z","title":"In: CVPR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.136609Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:8ea8b43ebac09548b99662989c53f75b376cfda78368cb88da2a27788a2b7d85","observation_id":"3abf51a1-b992-4091-9bf8-298c40cec3eb","resolution":{"observed_at":"2026-08-07T14:09:34.136609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:34.229292Z","title":"In: NeurIPS","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.229292Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:ba947539cee59d9c4756cfc3e452c27256b586a089540c8574bf625bcfaa2fae","observation_id":"842db2de-0367-43cd-b224-9ac481e72ee5","resolution":{"observed_at":"2026-08-07T14:09:34.229292Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.04768","last_updated":"2020-06-14T08:15:54Z","snapshot_observed_at":"2026-07-06T09:27:03.809621Z","submitted_at":"2020-06-08T17:37:52Z","title":"Linformer: Self-Attention with Linear Complexity","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.04768","snapshot_observed_at":"2026-08-07T14:09:34.348713Z","title":"arXiv preprint arXiv:2006.04768 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.348713Z"},"links":{"cited_paper":"/paper/2006.04768","citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:066ef21d3fb7a4ce3cfae7c448f544a9342b3bc98c3458181d62d6809e116bdd","observation_id":"6f1adbe7-8a57-4f46-a4a7-72cb882b780e","resolution":{"observed_at":"2026-08-07T14:09:34.348713Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:34.535352Z","title":"In: CVPR","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.535352Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:9378a5832771f1da56ce28ad4234192c34b366d330c929d3a075a49bc1583d84","observation_id":"a623655f-3da8-40bd-a609-4af8f0cd5717","resolution":{"observed_at":"2026-08-07T14:09:34.535352Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:34.728541Z","title":"In: ECCV","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.728541Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:d91e5d8f176610122a423fb3ab60e679f8bc08cdbaaf687ced590e87402f2c06","observation_id":"91a6f65c-daf6-4e50-9c06-fe18d80261ae","resolution":{"observed_at":"2026-08-07T14:09:34.728541Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:35.750407Z","title":"In: ECCV","venue":null,"work_id":"31b9f2d3-43d9-4abd-ae0d-577d06990e34","year":2018},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.798904Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:f8ae453e619a5cbb4e680b6a7cb812fe760b4b0342c9efc432883fdcc26c1259","observation_id":"1edd824e-98b0-4839-b559-b73b5f1652b1","resolution":{"observed_at":"2026-08-07T14:09:35.874670Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:35.541583Z","title":"In: ICCV","venue":null,"work_id":"1f9d724e-c909-48c8-a4b6-6c7702d4fb69","year":2021},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.857735Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:698d32b1052be83397c1727b80a067ca27b2009c7e5510218fda0fad2add4116","observation_id":"78ce1614-cd34-448c-97f2-a3501edfd912","resolution":{"observed_at":"2026-08-07T14:09:35.629996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:09:35.388883Z","title":"In: ACCV","venue":null,"work_id":"76e34020-64ad-4f7c-a826-4d653af2874e","year":2019},"citing_paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:09:34.940377Z"},"links":{"citing_paper":"/paper/2505.19928"},"observation_digest":"sha256:e20eabcf190b4a1eb55d713808391ae90104dd2aeac22e2dcab880af29dc45a1","observation_id":"08a1b07e-a4b6-4992-87fa-0401b0016d48","resolution":{"observed_at":"2026-08-07T14:09:35.438246Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.19928","last_updated":"2025-05-26T12:55:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T14:01:23.775793Z","submitted_at":"2025-05-26T12:55:27Z","title":"CA3D: Convolutional-Attentional 3D Nets for Efficient Video Activity Recognition on the Edge"},"reference_resolution":{"displayed":51,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":24},"total_outbound_references":51},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 51 of 51 outbound references and 0 inbound Pith citation observations for arXiv:2505.19928."}