{"as_of":"2026-08-15T15:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0095cefd7a0fb56545e0cbe524a3019f3298dba212a8d614d8d1e56bfb672028","coverage":[{"denominator":22,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":22,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-14T13:43:07.905464Z","state":"measured"},{"denominator":22,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":22,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/1908.04519/citation-record","integrity":"/paper/1908.04519/integrity","json":"/paper/1908.04519/citation-record.json","paper":"/paper/1908.04519"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"1904.06539","last_updated":"2019-08-06T12:47:41Z","snapshot_observed_at":"2026-08-14T16:47:05.128810Z","submitted_at":"2019-04-13T12:56:17Z","title":"HAKE: Human Activity Knowledge Engine","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1904.06539","snapshot_observed_at":"2026-08-14T13:43:07.666441Z","title":"HAKE: human activity knowledge engine","venue":null,"work_id":null,"year":1904},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.666441Z"},"links":{"cited_paper":"/paper/1904.06539","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:39c73f2b23fe4e6dc14b7c2c7da8fbd9d34984a6e69bf930eb0a5fd78516f326","observation_id":"b3dd9061-69ac-4eac-966d-86fa92ba462a","resolution":{"observed_at":"2026-08-14T13:43:07.666441Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1412.0767","last_updated":"2015-10-07T01:29:12Z","snapshot_observed_at":"2026-08-14T23:09:23.492133Z","submitted_at":"2014-12-02T03:05:54Z","title":"Learning Spatiotemporal Features with 3D Convolutional Networks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1412.0767","snapshot_observed_at":"2026-08-14T13:43:07.684018Z","title":"Bourdev, Rob Fergus, Lorenzo Torresani, and Manohar Paluri","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.684018Z"},"links":{"cited_paper":"/paper/1412.0767","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:74485483b03367d2efc0e8d52b0d4914df3eb1f1c0d6a997c01103c3f879c986","observation_id":"d2e48afa-0710-4f2e-a769-e14fcc791f10","resolution":{"observed_at":"2026-08-14T13:43:07.684018Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.10305","last_updated":"2017-11-28T14:24:18Z","snapshot_observed_at":"2026-08-14T20:09:21.478124Z","submitted_at":"2017-11-28T14:24:18Z","title":"Learning Spatio-Temporal Representation with Pseudo-3D Residual Networks","version":1},"cited_work":{"arxiv_id":"1711.10305","doi":null,"metadata_source":"pith","pith_arxiv_id":"1711.10305","snapshot_observed_at":"2026-08-14T13:43:08.859818Z","title":"Learning Spatio-Temporal Representation with Pseudo-3D Residual Networks","venue":"cs.CV","work_id":"a17fa708-def6-4989-8f01-19f65c4a3dd3","year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.697859Z"},"links":{"cited_paper":"/paper/1711.10305","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:074bc8a6d83b4d6f0952866355b422cffa4026e4d67b9ff17826f0e1916f72ec","observation_id":"be86eac4-0c5b-40b8-ab17-e26cd425cc95","resolution":{"observed_at":"2026-08-14T13:43:08.872055Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.04851","last_updated":"2018-07-27T03:20:56Z","snapshot_observed_at":"2026-08-14T20:04:01.300988Z","submitted_at":"2017-12-13T16:40:55Z","title":"Rethinking Spatiotemporal Feature Learning: Speed-Accuracy Trade-offs in Video Classification","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.04851","snapshot_observed_at":"2026-08-14T13:43:07.707481Z","title":"Rethinking spatiotemporal feature learning for video understanding","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.707481Z"},"links":{"cited_paper":"/paper/1712.04851","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:70e4a2314ba6b51c95da1182756b752c5d7bd9e3c04c35043b0a7918104f0ecc","observation_id":"e2bbf8a4-30d0-4adf-a10f-b1512fcbdfe0","resolution":{"observed_at":"2026-08-14T13:43:07.707481Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07750","last_updated":"2018-02-12T17:10:11Z","snapshot_observed_at":"2026-08-14T20:59:05.330633Z","submitted_at":"2017-05-22T13:57:53Z","title":"Quo Vadis, Action Recognition? A New Model and the Kinetics Dataset","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07750","snapshot_observed_at":"2026-08-14T13:43:07.720229Z","title":"Quo vadis, action recognition? A new model and the kinetics dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.720229Z"},"links":{"cited_paper":"/paper/1705.07750","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:3b6be0ba68c82b068f71c075a6574437d95e6c392de29ca98e5ff33ae31e20b0","observation_id":"72fed04d-7d93-4aed-a466-5c93098ed70d","resolution":{"observed_at":"2026-08-14T13:43:07.720229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.03982","last_updated":"2019-10-29T06:26:37Z","snapshot_observed_at":"2026-08-14T17:45:49.740913Z","submitted_at":"2018-12-10T18:59:07Z","title":"SlowFast Networks for Video Recognition","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.03982","snapshot_observed_at":"2026-08-14T13:43:07.729695Z","title":"Slowfast networks for video recognition","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.729695Z"},"links":{"cited_paper":"/paper/1812.03982","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:a8dc08afbe6eb24aed685bcd24cd372d01c8863027b5576afc673c909a7f049e","observation_id":"8552cb0d-75e2-4781-94b4-4557a986b755","resolution":{"observed_at":"2026-08-14T13:43:07.729695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.03762","last_updated":"2023-08-02T00:41:18Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-06-12T17:57:34Z","title":"Attention Is All You Need","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.03762","snapshot_observed_at":"2026-08-14T13:43:07.745937Z","title":"Gomez, Lukasz Kaiser, and Illia Polosukhin","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.745937Z"},"links":{"cited_paper":"/paper/1706.03762","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:b8a83eb222934b24d65901aad7e962b721477ba4085b3bfb50940dbf737565fd","observation_id":"867c5d3e-9fc8-4652-92cc-7bbdb3776942","resolution":{"observed_at":"2026-08-14T13:43:07.745937Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.07971","last_updated":"2018-04-13T06:40:44Z","snapshot_observed_at":"2026-08-14T20:11:21.532523Z","submitted_at":"2017-11-21T18:51:16Z","title":"Non-local Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.07971","snapshot_observed_at":"2026-08-14T13:43:07.754325Z","title":"Girshick, Abhinav Gupta, and Kaiming He","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.754325Z"},"links":{"cited_paper":"/paper/1711.07971","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:c6c7fe958bd4c80a35765e1cc7ddebc82c314eb82b4c733a1512f652890e4381","observation_id":"f6cbf1ec-6f80-43fc-adce-aa2575645383","resolution":{"observed_at":"2026-08-14T13:43:07.754325Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.02707","last_updated":"2019-05-17T14:17:25Z","snapshot_observed_at":"2026-08-14T17:47:20.903346Z","submitted_at":"2018-12-06T18:42:25Z","title":"Video Action Transformer Network","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.02707","snapshot_observed_at":"2026-08-14T13:43:07.768342Z","title":"Video action transformer network","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.768342Z"},"links":{"cited_paper":"/paper/1812.02707","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:c76cdc628e577e60875456ab1dc947acd0b04108190decd294cc94e8ddab7407","observation_id":"0fb3a362-7dd5-42e7-b12b-6324ec18ce0d","resolution":{"observed_at":"2026-08-14T13:43:07.768342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.05038","last_updated":"2019-04-17T19:05:30Z","snapshot_observed_at":"2026-08-14T17:44:39.673967Z","submitted_at":"2018-12-12T17:13:55Z","title":"Long-Term Feature Banks for Detailed Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.05038","snapshot_observed_at":"2026-08-14T13:43:07.775584Z","title":"Girshick","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.775584Z"},"links":{"cited_paper":"/paper/1812.05038","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:cb57cc24cf5a9f295fe10abd4629d069754d22607e92639e5a2f8a0b7b6c5267","observation_id":"2dc36ddd-6b5f-4f18-a765-b494687c3a91","resolution":{"observed_at":"2026-08-14T13:43:07.775584Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-15T11:35:18.832923Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-14T13:43:07.793614Z","title":"The kinetics human action video dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.793614Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:98c5474abbd593a1a5f17ebf81e99052065970ad700683ecc11290d8987db76a","observation_id":"d84c32b6-7dba-45ed-83e8-faca298ea32e","resolution":{"observed_at":"2026-08-14T13:43:07.793614Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1808.01340","last_updated":"2018-08-03T20:17:05Z","snapshot_observed_at":"2026-08-14T18:44:38.993682Z","submitted_at":"2018-08-03T20:17:05Z","title":"A Short Note about Kinetics-600","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1808.01340","snapshot_observed_at":"2026-08-14T13:43:07.803303Z","title":"A short note about kinetics-600","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.803303Z"},"links":{"cited_paper":"/paper/1808.01340","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:e0a6242017662d32c84b60f9be626756d8c6b970ecb97f3d3d53fc40a9fa3772","observation_id":"605ccf17-8e2d-433b-90fc-107fe4256686","resolution":{"observed_at":"2026-08-14T13:43:07.803303Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:43:09.086390Z","title":"Moments in time dataset: one million videos for event understanding","venue":null,"work_id":"458f8c0d-1394-4dce-abac-43658737d894","year":2019},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.811593Z"},"links":{"citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:120daba797589007c9d3b28785c665a539a8e3027f2b49838171a6b3f632d8da","observation_id":"408df1ac-c03b-4510-ad13-7b38a457154d","resolution":{"observed_at":"2026-08-14T13:43:09.102718Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:43:09.054812Z","title":null,"venue":null,"work_id":"ceb5a2f8-44f5-4719-83cf-af3252ec6bbb","year":2015},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.817094Z"},"links":{"citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:763625a60b46e61fa52a9001c31554f5371dd7fba14c25cf615d862dba86ec43","observation_id":"e3af1b65-53f7-4f46-8851-84dd85132ee9","resolution":{"observed_at":"2026-08-14T13:43:09.064335Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-14T13:43:09.021976Z","title":"Sigurdsson, Gül Varol, Xiaolong Wang, Ali Farhadi, Ivan Laptev, and Abhinav Gupta","venue":null,"work_id":"b16e29e3-58c1-45fc-9753-ff30cbcea570","year":2016},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.827176Z"},"links":{"citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:0ee19872711a3ee454b59ffe8ffd365541dbdb2ed794f96eb31b9cee83197745","observation_id":"80870d81-521d-4112-adbc-a659ebb4b612","resolution":{"observed_at":"2026-08-14T13:43:09.031843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.08421","last_updated":"2018-04-30T17:45:11Z","snapshot_observed_at":"2026-08-14T20:58:42.421734Z","submitted_at":"2017-05-23T17:11:46Z","title":"AVA: A Video Dataset of Spatio-temporally Localized Atomic Visual Actions","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.08421","snapshot_observed_at":"2026-08-14T13:43:07.834383Z","title":"Ross, George Toderici, Yeqing Li, Susanna Ricco, Rahul Sukthankar, Cordelia Schmid, and Jitendra Malik","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.834383Z"},"links":{"cited_paper":"/paper/1705.08421","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:4a5e422809e00798a32d969d1ec4a954eebc563aca3f2caf372365e487bac7bb","observation_id":"ff182fa5-01c6-4e99-8084-1cc7e4776dae","resolution":{"observed_at":"2026-08-14T13:43:07.834383Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1506.01497","last_updated":"2016-01-06T06:30:17Z","snapshot_observed_at":"2026-08-14T22:45:50.420062Z","submitted_at":"2015-06-04T07:58:34Z","title":"Faster R-CNN: Towards Real-Time Object Detection with Region Proposal Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1506.01497","snapshot_observed_at":"2026-08-14T13:43:07.844239Z","title":"Girshick, and Jian Sun","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.844239Z"},"links":{"cited_paper":"/paper/1506.01497","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:458dd1a21a6cd3eb3aa697dc6291b927abc78289728dca8bcf19507ee8361499","observation_id":"db1ee7c8-e62a-4b22-8f20-94a6db5e4f18","resolution":{"observed_at":"2026-08-14T13:43:07.844239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1708.02002","last_updated":"2018-02-07T18:44:44Z","snapshot_observed_at":"2026-08-14T20:42:52.429547Z","submitted_at":"2017-08-07T06:32:42Z","title":"Focal Loss for Dense Object Detection","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1708.02002","snapshot_observed_at":"2026-08-14T13:43:07.854201Z","title":"Girshick, Kaiming He, and Piotr Dollár","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.854201Z"},"links":{"cited_paper":"/paper/1708.02002","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:a66b6f7e21da6635c0cc6f108ca0930583556fe8ffa6519879ce5ba324a01d0b","observation_id":"6294e467-cb16-436a-95d1-2e567eae337a","resolution":{"observed_at":"2026-08-14T13:43:07.854201Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.00686","last_updated":"2018-06-29T07:49:08Z","snapshot_observed_at":"2026-08-14T18:57:42.668937Z","submitted_at":"2018-06-29T07:49:08Z","title":"YH Technologies at ActivityNet Challenge 2018","version":1},"cited_work":{"arxiv_id":"1807.00686","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.00686","snapshot_observed_at":"2026-08-14T13:43:08.179355Z","title":"YH Technologies at ActivityNet Challenge 2018","venue":"cs.CV","work_id":"7c409bac-8de5-4dc4-a5cf-ebde16d53085","year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.861043Z"},"links":{"cited_paper":"/paper/1807.00686","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:1f325e77fbb58420f942c2be8cd8899335f9cf9723d48cf7937c854a6fc34e6e","observation_id":"68698728-99e5-47d6-8e75-82933537359b","resolution":{"observed_at":"2026-08-14T13:43:08.188871Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.10066","last_updated":"2018-07-26T11:11:25Z","snapshot_observed_at":"2026-08-14T18:47:31.203366Z","submitted_at":"2018-07-26T11:11:25Z","title":"A Better Baseline for AVA","version":1},"cited_work":{"arxiv_id":"1807.10066","doi":null,"metadata_source":"pith","pith_arxiv_id":"1807.10066","snapshot_observed_at":"2026-08-14T13:43:08.106326Z","title":"A Better Baseline for AVA","venue":"cs.CV","work_id":"c8aac7d3-b396-4321-a41e-12c1d35c57bf","year":2018},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.874964Z"},"links":{"cited_paper":"/paper/1807.10066","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:72a02ee470df864847ac8124eda68fc4159acd3748e839d438f85f967286d988","observation_id":"810a9b00-183f-4ea3-ab7e-8de70dc12796","resolution":{"observed_at":"2026-08-14T13:43:08.121767Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1405.0312","last_updated":"2015-02-21T01:48:49Z","snapshot_observed_at":"2026-07-06T03:42:37.507458Z","submitted_at":"2014-05-01T21:43:32Z","title":"Microsoft COCO: Common Objects in Context","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1405.0312","snapshot_observed_at":"2026-08-14T13:43:07.887959Z","title":"Belongie, Lubomir D","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.887959Z"},"links":{"cited_paper":"/paper/1405.0312","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:26d1c8f00259e3ec18f8f9efb400aa04bf93a23bee78f732004204a7c05687e7","observation_id":"b8874b59-9822-4f13-a99c-4651d5a98701","resolution":{"observed_at":"2026-08-14T13:43:07.887959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1612.00137","last_updated":"2018-02-04T04:27:56Z","snapshot_observed_at":"2026-08-14T21:27:40.772250Z","submitted_at":"2016-12-01T04:36:52Z","title":"RMPE: Regional Multi-person Pose Estimation","version":5},"cited_work":{"arxiv_id":"1612.00137","doi":null,"metadata_source":"pith","pith_arxiv_id":"1612.00137","snapshot_observed_at":"2026-08-14T13:43:07.986714Z","title":"RMPE: Regional Multi-person Pose Estimation","venue":"cs.CV","work_id":"0c508d0f-1cd1-4c34-817b-0a9b856756da","year":2016},"citing_paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-14T13:43:07.905464Z"},"links":{"cited_paper":"/paper/1612.00137","citing_paper":"/paper/1908.04519"},"observation_digest":"sha256:7d32fe4d6d3a144aecc12035d86b9e4d134f25b23da494f635c0eb8475ba7951","observation_id":"260620be-d5ab-4be0-bc17-0e53b41fb72d","resolution":{"observed_at":"2026-08-14T13:43:07.997269Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"1908.04519","last_updated":"2019-08-13T07:23:44Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T08:55:36.433485Z","submitted_at":"2019-08-13T07:23:44Z","title":"Three Branches: Detecting Actions With Richer Features"},"reference_resolution":{"displayed":22,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":16,"verified_exact":4,"verified_fuzzy":2},"total_outbound_references":22},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 15 August 2026, this Paper Citation Record lists 22 of 22 outbound references and 0 inbound Pith citation observations for arXiv:1908.04519."}