{"as_of":"2026-08-24T00:56:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1020650195a2f48e494d2d5bfcf44d7fc2e3f762d9d92e008c93cd95d2bf75cf","coverage":[{"denominator":95,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":95,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T04:54:45.977701Z","state":"measured"},{"denominator":95,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":95,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-23T06:30:58.430688+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1909.02856/citation-record","integrity":"/paper/1909.02856/integrity","json":"/paper/1909.02856/citation-record.json","paper":"/paper/1909.02856"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.555832Z","title":"Deep residual learnin g for image recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.555832Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:39972fcead2d659e19d47f60573c8bcac8d58a5631a1f0c5641a59c290164bf5","observation_id":"a1bc8093-15ce-42f7-89ff-300f70f57fbd","resolution":{"observed_at":"2026-08-14T04:54:45.555832Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.560861Z","title":"Mask R-C NN,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.560861Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:ea831add7a3b5268cf4ee985ec23c7a22ec037715f06e6193aee410cb1c54e8c","observation_id":"78aaa526-42ad-423c-84fc-7ceb5cb40e09","resolution":{"observed_at":"2026-08-14T04:54:45.560861Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.565324Z","title":"Quo vadis, action recogni tion? a new model and the kinetics dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.565324Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:0fe21af39529c89fbdb7f4f24ad7e6ac4091813c6f6f41e3a45b2da697595dd0","observation_id":"79df8f43-a0b1-479d-b495-55b84cafda70","resolution":{"observed_at":"2026-08-14T04:54:45.565324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.570198Z","title":"Spatiotempor al multiplier networks for video action recognition,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.570198Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:e381582d1ae21ee1a9e6984e692100f9a6050f02074983e17c0cdceefe04b9ee","observation_id":"be11d48c-421d-4f57-95d6-dd6928cb605d","resolution":{"observed_at":"2026-08-14T04:54:45.570198Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.574867Z","title":"Deep b ilinear learning for rgb-d action recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.574867Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:f23549afeda6b9ebb70bd06908ea2b79c9a7dbe93a7acb2f416d947e877bc21b","observation_id":"bb5d28a3-d22c-4916-aa32-0500aaefb078","resolution":{"observed_at":"2026-08-14T04:54:45.574867Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.579534Z","title":"Tempora l relational reasoning in videos,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.579534Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:21074ca27a683db9cba6db4650b146e9ec7c958502e3274b047da0a3e08cb114","observation_id":"bd4cc6de-fe27-466b-8abc-dd68bca315a5","resolution":{"observed_at":"2026-08-14T04:54:45.579534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.584620Z","title":"Two-stream convolutiona l networks for action recognition in videos,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.584620Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:1e0aa56ebd6b2500ef0051f8fb5fcfcd4bd8babeafb6e901452ff76c3d316cf0","observation_id":"5f36172e-be60-457b-9604-0524fe37fff9","resolution":{"observed_at":"2026-08-14T04:54:45.584620Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.588762Z","title":"3D convolutional neural n etworks for human action recognition,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.588762Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:2791a7d55e6ff1d93cc3cd82c005f02414dda69167b9a5bb72104f8f855b6755","observation_id":"0acd5883-479c-4481-ab72-a099c8d5798a","resolution":{"observed_at":"2026-08-14T04:54:45.588762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.593365Z","title":"Moments in time dataset: one million videos for event understanding,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.593365Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:cc59c3c7ad8107681269abbc622eea8daf929214ec4532a33d310d504500a6f4","observation_id":"9df097f7-7469-444b-a71c-16b72afce47b","resolution":{"observed_at":"2026-08-14T04:54:45.593365Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.597729Z","title":"Convolut ional two-stream network fusion for video action recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.597729Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:99aacefd1a13bb03be249f6db8d60727fb07886042cd32dcf9202164b2a8ca4f","observation_id":"cf4e8c9a-98ee-455d-b594-50cb2b9d8e3c","resolution":{"observed_at":"2026-08-14T04:54:45.597729Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-08-17T19:17:06.411141Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-14T04:54:45.602063Z","title":"V ery deep convolutional networks for large-scale image recognition,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.602063Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:edbabf0b7c7a792d15bd9fb8572a640ccdf5c0c36308585b8b76f022674440b2","observation_id":"425e1a2d-65d2-4fbb-bc49-a9e310426936","resolution":{"observed_at":"2026-08-14T04:54:45.602063Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.607041Z","title":"Action recognition with t rajectory- pooled deep-convolutional descriptors,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.607041Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:eb0526a8605ae5e80896927f478e9a8edb14d7e808cd5401dd10a9f78e1ca682","observation_id":"18597f05-fc4e-48f2-a64c-2c9de43bc96d","resolution":{"observed_at":"2026-08-14T04:54:45.607041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.611370Z","title":"T wo-stream sr-cnns for action recognition in videos,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.611370Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:bf294420741a90fac57c8bfe84bfcb9a4b4c1199aa6250f8d0cfff9123030830","observation_id":"99b2ed33-b48f-4db3-a9eb-2b83a93e4609","resolution":{"observed_at":"2026-08-14T04:54:45.611370Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.615924Z","title":"Dynamic image networks for action recognition,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.615924Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:f48f144cb791a98676f1f7097aebb8bc1015a2ba78f8227b66b0f7941499a84d","observation_id":"644f3a1b-e2cd-47c6-9045-b2102182d728","resolution":{"observed_at":"2026-08-14T04:54:45.615924Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.620432Z","title":"Modeling video evolution for action recognition,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.620432Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:dc73bf58527a552b12dad48978785de47c418ae39124563831f585280c917a6c","observation_id":"39ada64e-dde9-4c71-98aa-d5ab37598ae7","resolution":{"observed_at":"2026-08-14T04:54:45.620432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.625102Z","title":"Non-linea r temporal subspace representations for activity recognition,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.625102Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:818cf0226ffbe5fc14cd5d9abf54489926f096580b48b953ef69c346f3898c4a","observation_id":"a5c25d9c-f486-43a7-b43e-aed958070cf3","resolution":{"observed_at":"2026-08-14T04:54:45.625102Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.291543Z","title":"Gene ralized rank pooling for activity recognition,","venue":null,"work_id":"fd7981c6-1a80-4b40-9979-6735c96c52f7","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.629554Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:209538602af993ae0b58ee5efcf560a15d3dca46288353e932c2c260b2946a38","observation_id":"b41feada-9065-4ebf-849b-f8723a8d18d5","resolution":{"observed_at":"2026-08-14T04:54:47.296108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1704.06925","last_updated":"2018-08-07T01:38:50Z","snapshot_observed_at":"2026-08-16T23:10:59.401112Z","submitted_at":"2017-04-23T14:10:55Z","title":"Second-order Temporal Pooling for Action Recognition","version":2},"cited_work":{"arxiv_id":"1704.06925","doi":null,"metadata_source":"pith","pith_arxiv_id":"1704.06925","snapshot_observed_at":"2026-08-14T04:54:46.048248Z","title":"Second-order Temporal Pooling for Action Recognition","venue":"cs.CV","work_id":"823c9107-2519-4c99-9519-7f5316b2608d","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.633902Z"},"links":{"cited_paper":"/paper/1704.06925","citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:73186674d92eb2fbcfad0af8a2bd3010f90459d3f7233b3f342662a4996f9cab","observation_id":"b7f0b6df-ba7a-4c65-b204-bbd3662b17a2","resolution":{"observed_at":"2026-08-14T04:54:46.055367Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.277272Z","title":"Higher-order poo ling of cnn features via kernel linearization for action recognition,","venue":null,"work_id":"d902887a-a4db-4749-9e1e-b084ec7f76cd","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.638643Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:fa99c3ae45c42f80d84685cc1ccde8f8348d2283735434ae57bba01dbe1bbe1c","observation_id":"7c8863ab-59f4-47b0-9151-8bc88fba7be7","resolution":{"observed_at":"2026-08-14T04:54:47.282108Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.262692Z","title":"Temporal segment networks: Towards good practices for dee p action recognition,","venue":null,"work_id":"276e5db7-95ef-466c-80c1-38e365839be1","year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.642819Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:84468d8b491da941a70ceef3bb1e0e3e07ff23e6a9e05936e3e582be91cdbf50","observation_id":"f0a0a528-5cf7-48eb-bceb-ea96e8380cc0","resolution":{"observed_at":"2026-08-14T04:54:47.267403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.248154Z","title":"Action snippets: How many frames does human action recognition require?","venue":null,"work_id":"0609d244-1236-46a6-bf49-582fd979fec3","year":2008},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.647169Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:24af416e22004b8a29b97b60200349b1d64effed4f59be1329525907c9c7f71a","observation_id":"b44197f9-68ae-4671-b032-fad72420018c","resolution":{"observed_at":"2026-08-14T04:54:47.253023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.232689Z","title":"Hmdb: a large video database for human motion recognition,","venue":null,"work_id":"2e26df33-aa64-41bf-bcda-b12ef69564b3","year":2011},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.651551Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:19f7bfa1f28c4eb0d69d8fa50a20ae86fdf5e5e8e98be3d274acf3362003522b","observation_id":"b539fd25-ec82-4104-a159-9758ca3ac40b","resolution":{"observed_at":"2026-08-14T04:54:47.237350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.217919Z","title":"UCF101: A dataset of 101 human actions classes from videos in the wild,","venue":null,"work_id":"1c01c50e-cb7e-4f63-a9ac-2b25fa06e824","year":2012},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.655702Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:824e13085f6246ab82aa9215ef039873312eecda876ed1d861ee9a6de9b1f20e","observation_id":"b297e5fe-9468-43c1-86c3-985ea1ad0af5","resolution":{"observed_at":"2026-08-14T04:54:47.222803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-20T22:03:51.775198Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-14T04:54:45.659864Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.659864Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:f8c731ef80b1bc8eaffb7a36d34270fd31ae4217ac38769b92fb00f552e0a6d9","observation_id":"e1bda540-a776-4a52-8dfd-9292d210eff5","resolution":{"observed_at":"2026-08-14T04:54:45.659864Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.203488Z","title":"Hollywood in homes: Crowdsourcing data collecti on for activity understanding,","venue":null,"work_id":"57c4d3df-6edf-4950-9797-63fdfdb52d97","year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.664390Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:d2f2d489719e46da213ef7de3e62fe4f204955e47c0f409a798046d13e470e2f","observation_id":"e0710881-a3c7-4355-80b9-585e19027fc2","resolution":{"observed_at":"2026-08-14T04:54:47.208241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.187548Z","title":"Action recognition based on a bag of 3d points,","venue":null,"work_id":"550493da-8437-4dba-b3b8-379f1dac96ef","year":2010},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.668897Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:0d161f83939ea182741f9cd428a05ebd9929f4dd9fa65deb4382d27657b2d765","observation_id":"c2b4a688-f004-4093-8f3e-4da76f0c2f0d","resolution":{"observed_at":"2026-08-14T04:54:47.192674Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.172071Z","title":"Ntu rgb+ d: A large scale dataset for 3d human activity analysis,","venue":null,"work_id":"e18dd688-dad5-4ca9-b269-722f6409a64c","year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.673047Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:f888227b28613cc9b014c0f05a889bb95d56e5f3986ef527ce3f32e446344d6d","observation_id":"c39dc17e-7e74-4e1b-8f17-63a78200e149","resolution":{"observed_at":"2026-08-14T04:54:47.176969Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.156732Z","title":"At tribute and simile classiﬁers for face veriﬁcation,","venue":null,"work_id":"3ed8382b-495b-4b7c-b8b2-8fda521f27cc","year":2009},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.677471Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:cb60fa1d05f85b10baca1c4f3950a4fbf7c878646a6490d09100126cfd750cfd","observation_id":"1e234cd2-1564-40d3-b13c-1c553c641ff4","resolution":{"observed_at":"2026-08-14T04:54:47.161764Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.141908Z","title":"Temporal res idual networks for dynamic scene recognition,","venue":null,"work_id":"1cdbd5d4-4eb4-4548-ad48-f47c257e6357","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.681754Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:8677413176bda9a4fad7c7adf7fef9e773c3349e17da49d1b48d3ec608e9ccc9","observation_id":"8b7f15e5-f0d0-4717-8192-2b6c34ab21b2","resolution":{"observed_at":"2026-08-14T04:54:47.146620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.126900Z","title":"Going deeper int o action recog- nition: A survey,","venue":null,"work_id":"9db86073-b7df-40a5-9e9e-35df357c6907","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.685891Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:4453c77e900a9495c03b48ee0eec6d9ef3c62769f7c39b27462002d1bb60b3ea","observation_id":"1a994ae4-238f-4748-9c17-e40a66d48623","resolution":{"observed_at":"2026-08-14T04:54:47.131821Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.111537Z","title":"A survey on vision-based human action recogn ition,","venue":null,"work_id":"ec6f4942-684f-487e-91c0-242ffd7afbd0","year":2010},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.690128Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:586a3e6f79b9a94b2eddb5374ff44af2c3604d47daa4f8e3b1ba2faec16a63fd","observation_id":"4a5caed6-ec67-4d5d-b54b-8ac019cd9025","resolution":{"observed_at":"2026-08-14T04:54:47.116277Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.694291Z","title":"Human activity analysis: A review,","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.694291Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:1abe6863be002322a61a10493555fe007c58ea87263d2efe779d639adb19100e","observation_id":"6101cc1f-2fde-4053-9525-166f4315b8fd","resolution":{"observed_at":"2026-08-14T04:54:45.694291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.086107Z","title":"Action re cognition by dense trajectories,","venue":null,"work_id":"e251dd10-dbcb-4523-8097-cf3c18587185","year":2011},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.698782Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:167ce199d77468c5c589152e854322e8bc8c831246e3db20430e4bf9be5b6f3a","observation_id":"1ca31d4c-d005-46e9-926d-bd7f066c40ea","resolution":{"observed_at":"2026-08-14T04:54:47.090774Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.071961Z","title":"Action recognition with improve d trajectories,","venue":null,"work_id":"78564b8f-219a-4d05-bc8d-a237a484228e","year":2013},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.703340Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:b056d7e3ddbb3a77a598322a1f6170013ebdde9013a5fd9309d3f636bcf8364f","observation_id":"ebc779c8-6ed7-4cfc-b3a5-f76adc616721","resolution":{"observed_at":"2026-08-14T04:54:47.076534Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.058103Z","title":"Action bank: A high-level r epresentation of activity in video,","venue":null,"work_id":"ba897b43-32fe-4b3f-8ce9-4600ec9a417b","year":2012},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.707965Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:8e5e8e387e7eeb6a7682c08d4047c902dead8bf4f606d845933872baabbba1f0","observation_id":"34ba4c2b-f302-465c-bbb9-f80e2ec69db7","resolution":{"observed_at":"2026-08-14T04:54:47.062614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.043575Z","title":"Video Google: A text retriev al approach to object matching in videos,","venue":null,"work_id":"4bdfec32-fce9-46cb-a49e-dd67103ebbf1","year":2003},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.712628Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:fa315bab30e29c5bfc99f5494f75ecea653d0f377a718817ec06777681b7938d","observation_id":"f9600deb-58ef-4ca0-9448-0f01976e8977","resolution":{"observed_at":"2026-08-14T04:54:47.048760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.028578Z","title":"Improving t he ﬁsher kernel for large-scale image classiﬁcation,","venue":null,"work_id":"4c5fa620-b5cf-4a21-8330-61be8cd6fe18","year":2010},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.717109Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:661f4df20f5576b594b2e36cb465b6d58df8e4af14905cb408aaa7c3b19a95a9","observation_id":"aa6f7c96-a4cd-482b-8c76-71bfed2c18f4","resolution":{"observed_at":"2026-08-14T04:54:47.033546Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:47.013569Z","title":"Aggregating local image descriptors into compact codes,","venue":null,"work_id":"016ff6e4-1b04-475d-9432-24fc5dc84189","year":2012},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.721430Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:b4d096c3adbc913258c3bd1f7353da06b78b9887a71c4e40c25abb349babbca4","observation_id":"04dcd060-192f-4611-9fea-f9390a0f9d62","resolution":{"observed_at":"2026-08-14T04:54:47.018569Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.997888Z","title":"Bag of visual word s and fusion methods for action recognition: Comprehensive stud y and good practice,","venue":null,"work_id":"eddbcf7c-60a4-4d57-aaa2-4c7e6d574680","year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.726202Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:683a023dd4a02e4972a83c509150ae0d862d668e8e0af2137b98e1ae4beedff4","observation_id":"97ab2649-c454-4954-99bd-f36ac35d484d","resolution":{"observed_at":"2026-08-14T04:54:47.002966Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.982151Z","title":"Imagene t classiﬁcation with deep convolutional neural networks,","venue":null,"work_id":"e6d2528b-cb93-4551-a07d-85629defb360","year":2012},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.730615Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:0eb4b9c32bd04675f6682bd07378a5158ba33d48e7c46dcfb46a62150f9f8d32","observation_id":"4461d61e-0e56-4b86-82d2-67674c8f6312","resolution":{"observed_at":"2026-08-14T04:54:46.987091Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.967118Z","title":"Deep reconstruction models for image set classiﬁcation,","venue":null,"work_id":"a371f52c-6c35-4e78-853b-2da1ce22ba4e","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.735113Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:89d153e9aeaea9e48005514c7f9b520d32bdc5d07437b000a6d563f3658fd4c5","observation_id":"4f2f077e-3d21-45be-910a-ccb8bc422603","resolution":{"observed_at":"2026-08-14T04:54:46.971904Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.952357Z","title":"Interpretable 3D human action a nalysis with temporal convolutional networks,","venue":null,"work_id":"a4a179e6-2c70-4d5f-a14f-f5269a09e3e8","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.739671Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:1fcd30415d99ef0f38ccbf284a0c312cf7bf4daf9e51ef7cce31ba33113a9e25","observation_id":"efc2dc73-8f7e-4c17-aad4-258ca71c099d","resolution":{"observed_at":"2026-08-14T04:54:46.957188Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.936504Z","title":"Sequen- tial deep learning for human action recognition,","venue":null,"work_id":"1f896c17-70df-4994-a1d3-2c063784b9fe","year":2011},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.744255Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:ad9208b243b37a78567b1f3fd306562736c0bd2eea3ac3b0d0a4c495df4259e6","observation_id":"16bd559f-31d8-4f62-9f58-a7d9f0d99e7d","resolution":{"observed_at":"2026-08-14T04:54:46.942048Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.919671Z","title":"Long-term recurrent co nvolutional networks for visual recognition and description,","venue":null,"work_id":"9b6b1516-77ab-4381-81f1-2c9ed9ce750b","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.749241Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:332a57e84724fc6093d0cd23c3ee08e08729ec66ff5a64ac33ddaf0ed9084ffe","observation_id":"6542165a-dcd4-4834-ab75-88b6c815d655","resolution":{"observed_at":"2026-08-14T04:54:46.924772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.904281Z","title":"Hierarchical recurrent neu ral network for skeleton based action recognition,","venue":null,"work_id":"ad079b44-1008-42b0-87ed-5bc9a04dbad4","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.753847Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:de908e61876df643a6408bd39f61aeb1f25807c7f6da924d262083c8cbb5f898","observation_id":"5bdc2454-3703-43d3-87c9-13607f47c1b9","resolution":{"observed_at":"2026-08-14T04:54:46.909210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.889327Z","title":"Action re cognition by learning deep multi-granular spatio-temporal video rep resentation,","venue":null,"work_id":"a097514a-d0c2-4bb7-9008-2deaccd23b2d","year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.758155Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:93871484e16b961fb386f034d3feb807cb16d872c1e94cb2487e8c67ff62f4f5","observation_id":"c48d3604-56a2-4c7c-bb87-27a26e4827b8","resolution":{"observed_at":"2026-08-14T04:54:46.894155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.873580Z","title":"Uns upervised learn- ing of video representations using lstms","venue":null,"work_id":"42a60a7d-2488-42f2-8e14-626b472c4e7d","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.762294Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:fb7ff05630ddd7ff121ea7066ca1b844297798fd20aacf8bb94744e00960bc19","observation_id":"654e5bcd-8ba7-4e01-accc-949c83c54b4c","resolution":{"observed_at":"2026-08-14T04:54:46.878814Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.858737Z","title":"Beyond short snippets: Deep netw orks for video classiﬁcation,","venue":null,"work_id":"de31ab16-8c43-4526-93fe-e8a0a4cc4789","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.766575Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:a3802972ef6619d857623c3aed4b98fcf10eb8ebdd73e386a2c205af4c4a4217","observation_id":"fcf10f4f-ac25-4607-a89e-13b632193b78","resolution":{"observed_at":"2026-08-14T04:54:46.863564Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:45.770890Z","title":"On the difﬁculty of training recurrent neural networks,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.770890Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:afc9c41eb36195af85ac0c7ef5ca8ee19258833d1299f6eb8880124f7d02257b","observation_id":"2fa61d0a-b851-4cc5-b029-d54e58d8f6b2","resolution":{"observed_at":"2026-08-14T04:54:45.770890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.834095Z","title":"Learning spatiotemporal features with 3D convolutional networks,","venue":null,"work_id":"3133b1c3-5137-4578-9561-485c1a765987","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.775198Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:d2f4978a001119fe824a6f3c19f370e69bb313626177857498431cf830c66c7a","observation_id":"73d0e870-118a-47b0-99ef-7e67d70f947c","resolution":{"observed_at":"2026-08-14T04:54:46.838726Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.819466Z","title":"Non-local neu ral networks,","venue":null,"work_id":"6e318497-b5bb-45ee-8015-c5b8c01d8871","year":2018},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.779495Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:30d603ae288e2c7aa72e7a1166fdf72e539ce1c29058d9338d8cac295125f10d","observation_id":"a6b9bee5-7fe1-423d-9358-9603ab96de60","resolution":{"observed_at":"2026-08-14T04:54:46.824058Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.804610Z","title":"Mict: Mixed 3d/2 d convolu- tional tube for human action recognition,","venue":null,"work_id":"e0d756a8-0149-46f7-ba72-2a6dcec054db","year":2018},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.784092Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:428cef67d2dd980146947806842a5298c6f8abd0253a817aa0f1360facaa1025","observation_id":"73da31b3-a882-4080-a74e-f5778b4d8054","resolution":{"observed_at":"2026-08-14T04:54:46.809808Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.790257Z","title":"Appearance-and-r elation networks for video classiﬁcation,","venue":null,"work_id":"5841f5ba-9c3a-4c57-ae9c-74d30ade44ec","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.788563Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:2131b06ed5d442cff660582416c5ae4cea30ab904a6ba75afdf13f2a28672fd1","observation_id":"b2154ec1-bc5d-4dee-ba63-a3d61d93e80c","resolution":{"observed_at":"2026-08-14T04:54:46.794994Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.775231Z","title":"Second-order temporal poolin g for action recognition,","venue":null,"work_id":"59412297-0616-44a2-9251-1a80d05433f7","year":2018},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.792815Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:cc21ebbecd6e723a49270bd4393c78215c1decdc5b0df64e30c29a171fc27f1a","observation_id":"9fee8a0c-5d43-4f6b-9c02-2e4e3787d9d2","resolution":{"observed_at":"2026-08-14T04:54:46.780183Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.664022Z","title":"Action- VLAD: Learning spatio-temporal aggregation for action cla ssiﬁcation,","venue":null,"work_id":"baadc145-11f9-4c9b-a125-a4873e3fecb1","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.797416Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:009f7d7306e4ab23e24e57e8e7f188a8963f87e0611e662c6bc6ae4aee4e77cf","observation_id":"86be99bb-6d59-4a44-8bb5-f5e27d07dbed","resolution":{"observed_at":"2026-08-14T04:54:46.668903Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.650768Z","title":"Dynamic pooling fo r complex event recognition,","venue":null,"work_id":"080bbd4a-2929-4044-9118-0a24aafd9a4d","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.801944Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:cb7d239ae80b4dffde9e5c79e5f3a58071d76f19d7ae236564d1aac587029e25","observation_id":"b8c423a4-e214-4de6-8724-10baad7aa38e","resolution":{"observed_at":"2026-08-14T04:54:46.655129Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.635626Z","title":"Ensemble of e xemplar-svms for object detection and beyond,","venue":null,"work_id":"c71de437-cbdd-4654-bf0d-e7514b6f07f5","year":2011},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.806566Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:b1f349aa7d7c91aedf8ccd04dfa0c12fb60035c7407ef22a73f8703cf650eaca","observation_id":"2c116cc3-2ef6-4f22-8063-8e6f32928e6c","resolution":{"observed_at":"2026-08-14T04:54:46.640892Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.621300Z","title":"Exemplar- based action recognition in video","venue":null,"work_id":"6c0a4962-2d6f-47e6-a355-dcdb0703c0e5","year":2009},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.811065Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:64a74bdddb38b448c96d7316cca510f443244b5624364fa471aac6c4f7b1134a","observation_id":"be8c3166-956e-4690-b39a-5a9be1b1d8b6","resolution":{"observed_at":"2026-08-14T04:54:46.625868Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.606253Z","title":"Exemplar svms as visual feature encoders,","venue":null,"work_id":"3711587f-7591-4c40-9e9d-f10f55002d7c","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.815531Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:4b58de49250fe9cb937bdc8031fe9361e5e0fd047b777a6c0a018744feabf508","observation_id":"17fc9ad4-1372-4d54-a6fc-2b36692e1e80","resolution":{"observed_at":"2026-08-14T04:54:46.611206Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.591789Z","title":"Weakly supervi sed object localization with multi-fold multiple instance learning,","venue":null,"work_id":"e5a09258-81ed-46e9-abe6-449bbf1c8a41","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.820290Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:dc7b5fffd44cb66bddafffebc5a3ba6588a2e4dd7be85815711e004faaa8e78d","observation_id":"1868ad03-871f-4484-8536-67053b409d1f","resolution":{"observed_at":"2026-08-14T04:54:46.596307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.577852Z","title":"Multiple instance learning f or soft bags via top instances,","venue":null,"work_id":"8a2553e7-eb6a-47f3-b0fc-b4f5916619bc","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.825340Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:24933b73b71529bcadbfd80d6fe23bca41e512eb5e015fc409480b35de1b747b","observation_id":"7a95be16-16a2-46dd-b5dd-01bad75dc54f","resolution":{"observed_at":"2026-08-14T04:54:46.582486Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.563954Z","title":"Deep multiple instance learning for image classiﬁcation and auto-annotation,","venue":null,"work_id":"66a9a78e-3342-41db-b27f-f279e6169423","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.829872Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:56cd3aebacca324bc0d2e741e3f20de3fae06a952b14113db065320e6518c65f","observation_id":"42c75172-d16e-479a-a19e-3b1a8114d05e","resolution":{"observed_at":"2026-08-14T04:54:46.568487Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.549215Z","title":"Human action recognition with graph-b ased multiple- instance learning,","venue":null,"work_id":"08f35c27-4314-451b-bb81-eff6cdf94063","year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.834291Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:8738fe2feb1da07a5debe029b050a22da0cde5f3e21814e503bd658eab6039c6","observation_id":"73dddd1c-e5ad-46a1-87e6-ba4178fecf9e","resolution":{"observed_at":"2026-08-14T04:54:46.554623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.534485Z","title":"A s elf- paced multiple-instance learning framework for co-salien cy detection,","venue":null,"work_id":"a00d8170-7f32-4d9f-92a9-8475494072bf","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.838740Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:a7f923ed1e730db2bd93eab504255678cbacc200edf00f9c6f5abcf4f2f9b404","observation_id":"8110ccb9-c82e-4908-8be1-f74f89a4e88c","resolution":{"observed_at":"2026-08-14T04:54:46.539451Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.518960Z","title":"Modeling the temporal extent o f actions,","venue":null,"work_id":"dbc6e094-c7fb-4997-a9b8-f676449322b3","year":2010},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.843097Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:4b55695d2da8563995fe3315584f1d80573b04ef976d58450efc71c46e4e4db1","observation_id":"549d38ff-6274-4550-b2dd-d125d872ddd1","resolution":{"observed_at":"2026-08-14T04:54:46.524147Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.503735Z","title":"Discriminative sub sequence mining for action classiﬁcation,","venue":null,"work_id":"05566819-b975-4665-8923-aa3ec6af8025","year":2007},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.847387Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:7f189adc7ed5e516ec606552163b6d9c7977aa6c57e0c1e1a90ac8b2e65e44c5","observation_id":"98d7cf08-657a-4dd0-a845-d643d870fc1f","resolution":{"observed_at":"2026-08-14T04:54:46.508715Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.487488Z","title":"Dynamic pooling for complex event recognition,","venue":null,"work_id":"591bbaf5-903b-4267-a627-6ba1c8d9b563","year":2013},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.851655Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:6033ec6115ae6c38f045a0915f45dd02f5715fe7e5a4c372ad88f5d77f471308","observation_id":"e275b563-ce4e-4f86-b498-c55228071204","resolution":{"observed_at":"2026-08-14T04:54:46.492385Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.472732Z","title":"Discover: Discovering importan t segments for classiﬁcation of video events and recounting,","venue":null,"work_id":"b9ba2091-e333-498f-b61c-9d7d9ff99ab9","year":2014},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.856268Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:1c38aa435a952ba60815cbbb4ad6f626f97151d5eaaef7dc9ad630c37d7b10de","observation_id":"a7916bc8-577a-4e3c-ab4d-075611ccc8b8","resolution":{"observed_at":"2026-08-14T04:54:46.477786Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.458776Z","title":"Compos itional models for video event detection: A multiple kernel learnin g latent variable approach,","venue":null,"work_id":"96f667ca-e5aa-4d2c-8946-bca7981f9578","year":2013},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.860598Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:e858d4e74344af033e0a73fe9c446b8f30dee4b6f5c3ab3c95b13a45ef0e1d1b","observation_id":"70cce6c4-6246-481e-b5aa-20c200a50a78","resolution":{"observed_at":"2026-08-14T04:54:46.463061Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.444971Z","title":"Multi-instance kernels","venue":null,"work_id":"e0c51756-af8e-46d4-939b-9c86dd47d034","year":2002},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.864864Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:2c1454b6df55c032fcdbca847e84a8051473fe66ada7054ade53d00d0232ff7a","observation_id":"eb9c8312-4e13-4a4e-b0bc-172d838e0971","resolution":{"observed_at":"2026-08-14T04:54:46.449496Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.430174Z","title":"Video e vent detection by inferring temporal instance labels,","venue":null,"work_id":"053663b7-2f5c-41ba-8515-87bea3102ad1","year":2014},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.869398Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:2ed2c3fb994c7e12c9bb1d3aa6ec31eebb581b0d1ba19d799f29e2e512ca717a","observation_id":"187faa32-658c-45dc-9ffb-025194d84c4e","resolution":{"observed_at":"2026-08-14T04:54:46.435015Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1306.0886","last_updated":"2013-06-04T19:35:31Z","snapshot_observed_at":"2026-08-16T05:15:42.557147Z","submitted_at":"2013-06-04T19:35:31Z","title":"$\\propto$SVM for learning with label proportions","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1306.0886","snapshot_observed_at":"2026-08-14T04:54:45.873863Z","title":"propto svm for learning with label proportions,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.873863Z"},"links":{"cited_paper":"/paper/1306.0886","citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:1169fd5dcd591ed80760d61888330da7b62aa3855ee24a1a5f2cd3587f34c4ad","observation_id":"a2c8569b-bc08-4db5-9e61-e96fac9b0e2f","resolution":{"observed_at":"2026-08-14T04:54:45.873863Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.413172Z","title":"Video rep resentation learning using discriminative pooling,","venue":null,"work_id":"b7956b2d-7392-4d57-a32d-433ca0935180","year":2018},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.878902Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:758e43633bf9ea192d392ab2a5283eb3f15f78f2951fa6dca861bfdbb494ec93","observation_id":"e6748c6f-6823-4aa0-9ec0-e10f1986dc80","resolution":{"observed_at":"2026-08-14T04:54:46.418872Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.398023Z","title":"Multiple instance learn ing for sparse positive bags,","venue":null,"work_id":"0aa43ddc-a93a-44e6-b774-03f2861d799c","year":2007},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.883263Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:486dda8672c60384434f267979188daf6320379748ffe8c799d3811a1c306550","observation_id":"da1c9c61-0bb5-430b-bd51-97143299481a","resolution":{"observed_at":"2026-08-14T04:54:46.403006Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.383210Z","title":"Mixed-integer quadratic programming,","venue":null,"work_id":"f13e82fd-90bc-4b05-b745-084fc502ca34","year":1982},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.887630Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:011fc5655626b5ab163aefd852d4d487d66c08026c8d15980bdf7383d741315c","observation_id":"77d93497-973e-413f-9d5a-c86f659fdd41","resolution":{"observed_at":"2026-08-14T04:54:46.388190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.367561Z","title":null,"venue":null,"work_id":"cdb30065-7cb7-4090-b137-9dafd1800bc6","year":1998},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.892408Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:dad7f4b465683d459068e704cdd5840fb541533c7c2e8c83be080884bcbec652","observation_id":"8b378f2f-40f0-4a05-a775-8cefbb9796bb","resolution":{"observed_at":"2026-08-14T04:54:46.372607Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.352452Z","title":"Efﬁcient additive kernel s via explicit feature maps,","venue":null,"work_id":"28bc7ba6-d2f0-468f-82b1-b3da76f3267f","year":2012},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.897057Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:c2ba1e4a215606ca47df064efa10009377adfb457663de7cc9bd8918b4ff77d0","observation_id":"e5c6fb3a-6f56-4b4d-965c-bed6d3fadc59","resolution":{"observed_at":"2026-08-14T04:54:46.357209Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.337934Z","title":"Ma nopt, a Matlab toolbox for optimization on manifolds,","venue":null,"work_id":"bba5323e-2a4e-42ed-a6df-eb04eda80fca","year":2014},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.901606Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:77228546ed0d24776ac5278752fe3a11a577de844ea50b7b3cae2a1b1e3203a2","observation_id":"afee1cee-6cdb-41a6-bb30-ae2f1059853b","resolution":{"observed_at":"2026-08-14T04:54:46.342810Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.323544Z","title":"Implicit functio ns and solution mappings,","venue":null,"work_id":"eecd580e-5518-43c2-a251-3f297869a388","year":2009},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.906105Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:1f7d2811be3e8cc0eba0dc19fd7e3b6df5f510592ee311ef353ab80070bb1694","observation_id":"f2410dca-d32a-422c-99f2-28a5d10f7f5c","resolution":{"observed_at":"2026-08-14T04:54:46.328144Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.307966Z","title":"On differentiating parameterized argmin and argmax probl ems with application to bi-level optimization,","venue":null,"work_id":"7449acf5-1d69-48c7-b450-7f180792f6aa","year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.910678Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:aff4cc65e357a0447c755878d27f515b4afb0927d62278086a28d66f83c736cc","observation_id":"f4766cbb-5850-407d-b4d4-75e341e4f793","resolution":{"observed_at":"2026-08-14T04:54:46.313126Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.293200Z","title":"Asynchronous temporal ﬁelds for action recognition,","venue":null,"work_id":"9d556813-f6c9-4b14-9d56-bbe4a918ef39","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.915276Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:4e3bc04ab91da8f735a9e45fb145cd09e97eed7befe675e55a50e6469d1def2d","observation_id":"58b967a5-a010-476d-8b5a-52163d24a27e","resolution":{"observed_at":"2026-08-14T04:54:46.298230Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.278933Z","title":"Human act ion recognition by representing 3d skeletons as points in a lie group,","venue":null,"work_id":"080d27a5-0044-43dc-aaed-1cd7ced1a42f","year":2014},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.919757Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:2c677bb069419e1d6818d95dca3ab82e7608e2a159f4a42eaec2c893ebb0f7ce","observation_id":"5e9f2654-cedf-4e3d-b6bf-81819aff4b6b","resolution":{"observed_at":"2026-08-14T04:54:46.283926Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.264605Z","title":"Do We Really Need to Collect Millions of Faces for Effective Face Recogni tion?","venue":null,"work_id":"247e8f80-397f-43c6-88cd-a1881e3f844f","year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.924313Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:72100572fdf8d31bd4964a929de35dfbdbd670fee638d81ada253f429f476f81","observation_id":"4a41673f-1a52-4f1e-8759-c5e9de0c78cc","resolution":{"observed_at":"2026-08-14T04:54:46.269631Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.250672Z","title":"Inc eption-v4, inception-resnet and the impact of residual connections on learning","venue":null,"work_id":"e87cccee-f151-46a2-96bc-00f81b12cc92","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.929275Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:2f273eee386855f35b4a42d89a978f6ef01b643378d4f4130ec5ca4fe168cb43","observation_id":"6a389946-2910-4222-91e0-ad8ae22a42e8","resolution":{"observed_at":"2026-08-14T04:54:46.255292Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.236015Z","title":"Activ- itynet: A large-scale video benchmark for human activity un derstanding,","venue":null,"work_id":"5ad45a92-a7ed-477d-b966-596b00fa6f45","year":2015},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.933745Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:d60390530730121ff6d6c8023ebd3533825b868d61ae03e4af053356af7918d4","observation_id":"83770fbb-6bd6-4fca-9e1f-61fe69102596","resolution":{"observed_at":"2026-08-14T04:54:46.240739Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.221511Z","title":"Spatiotempo ral residual networks for video action recognition,","venue":null,"work_id":"c443a8d0-4723-4f49-84bb-a5d57c05e9de","year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.938181Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:ff4d1e775c8e00d21dc86da9669af7b28a3642a53a7353157e41fd5bbe3e5ba9","observation_id":"90ca4eba-260e-4234-a60e-6c77edc0c221","resolution":{"observed_at":"2026-08-14T04:54:46.226331Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.206637Z","title":"Caffe: Convolutional archi tecture for fast feature embedding","venue":null,"work_id":"913a07e6-9ce7-484d-b5c7-e755eef196df","year":2014},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.942558Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:f6922d94eb0fa5f5e6fbe4e529f0f296cdc61f0423e338f8a7a6ac14efd7e91b","observation_id":"e31e59ba-7ce6-4ef5-b1ac-cf25cda9f45a","resolution":{"observed_at":"2026-08-14T04:54:46.211371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.192397Z","title":"A short note about kinetics-600,","venue":null,"work_id":"a43d91cf-029a-4135-87b6-320014823f9b","year":2018},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.946948Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:e11b957eae8055061731935095ecc912e6e2920e3fe1df6140f707035ad6d25b","observation_id":"16355882-7683-4c22-9ce2-88d7019b30ac","resolution":{"observed_at":"2026-08-14T04:54:46.196722Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.177885Z","title":"Adascan: Adapti ve scan pool- ing in deep convolutional neural networks for human action r ecognition in videos,","venue":null,"work_id":"2d32b6b7-85aa-4177-a659-02c3c52b64df","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.951235Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:1fea675c12397cf09239c31bb70a30f7afed6a4ff85a8d871fe7a55561387b90","observation_id":"63b7f0c1-720e-45b1-a3ea-e055019bb8c8","resolution":{"observed_at":"2026-08-14T04:54:46.182668Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.161256Z","title":"Disc riminative hierarchical rank pooling for activity recognition,","venue":null,"work_id":"78e6369e-a83d-4d05-ae30-77c1a0d6c2e2","year":2016},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.955467Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:d30c7b374ddfaccea8057ed546049bcbc45e9bd1091c6478cc3f327be24a24a8","observation_id":"0ac55f7b-1932-40c4-bcd5-0ea1c865476b","resolution":{"observed_at":"2026-08-14T04:54:46.167399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.145175Z","title":"Deep inside convolutional networks: Visualising image classiﬁcation models and sali ency maps,","venue":null,"work_id":"325b0091-a21c-41cc-bc4d-c07b02d9bc8a","year":2013},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.959677Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:42a098994db558006ed5e3cced59574dacd1d98b01f607cf1c11c3b873f86892","observation_id":"bec1b070-b820-432a-8174-09b0e8a8fd52","resolution":{"observed_at":"2026-08-14T04:54:46.149888Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.130036Z","title":"Actionvlad: Learning spatio-temporal aggregation for action classiﬁc ation,","venue":null,"work_id":"30df2aab-bf3d-4bd4-894f-005a40ad4091","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.964325Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:e0652bc413daa913b0a82ad2290408ba926f0f78c5efdaf29a3160b4f8153cb2","observation_id":"ceea7aae-0b66-41b4-98b6-bf0236a33cd0","resolution":{"observed_at":"2026-08-14T04:54:46.134968Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.114299Z","title":"Skele ton-based action recognition using spatio-temporal lstm network wit h trust gates,","venue":null,"work_id":"3610981c-26d8-4a47-ac5d-c2500b677685","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.968899Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:6dae109139cbcc558e0a3dd12a5ccfc69c20de0049811bf7e48b8d6e25f9ef2a","observation_id":"6c855118-c07b-4744-9dfd-19deb6d7dad6","resolution":{"observed_at":"2026-08-14T04:54:46.119224Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.097465Z","title":"Empowering simp le binary classiﬁers for image set based face recognition,","venue":null,"work_id":"c3c1081c-dc99-445e-a6c7-2931501bd9f0","year":2017},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.973203Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:ba17a267184a002bb09d4ced2677560816ae8e474eea0a5309bbdf39fbfaced0","observation_id":"53ff00fa-19e5-4fb0-89c8-9b7e78104cc4","resolution":{"observed_at":"2026-08-14T04:54:46.102825Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T04:54:46.081927Z","title":"Dense tra jectories and motion boundary descriptors for action recognition,","venue":null,"work_id":"324214ab-0026-404b-95fb-6c1a5e485c84","year":2013},"citing_paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-14T04:54:45.977701Z"},"links":{"citing_paper":"/paper/1909.02856"},"observation_digest":"sha256:dbeda31686cc5472494b88f45a6e9e51322399bdb7a3d9530cabc51deca15615","observation_id":"affe3d02-0d20-4788-91c6-479b4d34844f","resolution":{"observed_at":"2026-08-14T04:54:46.087100Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-23T06:30:58.430688+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1909.02856","last_updated":"2019-09-05T16:12:27Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-20T01:55:45.913664Z","submitted_at":"2019-09-05T16:12:27Z","title":"Discriminative Video Representation Learning Using Support Vector Classifiers"},"reference_resolution":{"displayed":95,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":21,"verified_exact":1,"verified_fuzzy":73},"total_outbound_references":95},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-23T06:30:58.430688+00:00","source":"crossref"},{"observed_at":"2026-08-23T06:30:53.778098+00:00","source":"retraction_watch"}],"thesis":"As of 24 August 2026, this Paper Citation Record lists 95 of 95 outbound references and 0 inbound Pith citation observations for arXiv:1909.02856."}