{"as_of":"2026-08-12T13:16:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:0ad51babd2152abc3d3d7c7ab1638d17da160ab53fae1b6896f73780b8812351","coverage":[{"denominator":66,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":66,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T19:17:01.216603Z","state":"measured"},{"denominator":66,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":66,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.07072/citation-record","integrity":"/paper/2412.07072/integrity","json":"/paper/2412.07072/citation-record.json","paper":"/paper/2412.07072"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2007.10703","last_updated":"2020-07-21T10:45:05Z","snapshot_observed_at":"2026-08-12T13:03:08.015283Z","submitted_at":"2020-07-21T10:45:05Z","title":"Uncertainty-Aware Weakly Supervised Action Detection from Untrimmed Videos","version":1},"cited_work":{"arxiv_id":"2007.10703","doi":null,"metadata_source":"pith","pith_arxiv_id":"2007.10703","snapshot_observed_at":"2026-08-11T19:17:01.992715Z","title":"Uncertainty-Aware Weakly Supervised Action Detection from Untrimmed Videos","venue":"cs.CV","work_id":"96761781-a0ae-4ee4-823e-911ee9d79207","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.630207Z"},"links":{"cited_paper":"/paper/2007.10703","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:1eb4465d8d9e5cb67235853fdbfee83c6f824dcd1adacf28f9683636d3eacfc9","observation_id":"f0e23199-16b5-4b30-8023-2e4f43e1981c","resolution":{"observed_at":"2026-08-11T19:17:02.024741Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.884741Z","title":null,"venue":null,"work_id":"d5a6e6e6-1a41-4106-9547-ff4e747f3caa","year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.650290Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:ffa96525cd2ae57756e50cb98ddcee582352205b55349a28ce3fe375f25fd258","observation_id":"5527bde5-420c-402c-a484-d290c10aa15e","resolution":{"observed_at":"2026-08-11T19:17:03.915483Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2005.12872","last_updated":"2020-05-28T17:37:23Z","snapshot_observed_at":"2026-08-10T14:01:30.291640Z","submitted_at":"2020-05-26T17:06:38Z","title":"End-to-End Object Detection with Transformers","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2005.12872","snapshot_observed_at":"2026-08-11T19:16:59.674748Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.674748Z"},"links":{"cited_paper":"/paper/2005.12872","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:3e5a1a484bf9c5ae4ffe24dea171fd785b02241b5dff3b25b5743345e55d1ace","observation_id":"d4c3f6a6-cc7f-4a8a-9368-7e9c07edeecd","resolution":{"observed_at":"2026-08-11T19:16:59.674748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.714740Z","title":null,"venue":null,"work_id":"9d8bd6bc-e251-4333-913f-47b904dd67fb","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.714741Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:7219e38fcc98f131b3b3cb67816c7a500bd190c176de280299ffc28780399e80","observation_id":"f52dfece-ef32-434d-b656-c434f63604ba","resolution":{"observed_at":"2026-08-11T19:17:03.764746Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:16:59.734926Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.734926Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:521ec97b97a42606122e246f506c509289619b7ccd22a1805282090ba665b858","observation_id":"e2a66422-d6c4-4c7d-8c77-9898702cdaad","resolution":{"observed_at":"2026-08-11T19:16:59.734926Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:16:59.744738Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.744738Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:6a6058df6e3d3588cdda55dc82f695fd5e5065c95fd17104dd0f5f5f3ab76331","observation_id":"59caaf9f-b318-4cb8-b9be-9bc772bc03b5","resolution":{"observed_at":"2026-08-11T19:16:59.744738Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.394739Z","title":null,"venue":null,"work_id":"09486739-3a0e-4771-b35e-5a0f208d1338","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.754809Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:51384c368a47294f573792d24f47022fa826451e4002df5c8f8195111c4f5485","observation_id":"b078a8e2-63a8-4c26-9947-2c1fcd11077e","resolution":{"observed_at":"2026-08-11T19:17:03.424740Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.264746Z","title":"S.; and Shah, M","venue":null,"work_id":"0fedf936-bbce-4c5a-8881-e72c0cf8c030","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.794752Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:18315379ff7a3dfd692fe1ee42e5237be559a885b32407b49cf00468d558ad9d","observation_id":"ff4b32b3-1aea-41b4-8197-b5f2c896394e","resolution":{"observed_at":"2026-08-11T19:17:03.294740Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.123549Z","title":"S.; and Shah, M","venue":null,"work_id":"a94cacf7-f766-4282-a745-c2bdab9214b0","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.814737Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:48f3f8fb433e9d7b2b85ebc009d5c4f94d1f5602f6050ce42731744d3643a636","observation_id":"95e6d909-9e21-421f-9c6d-fca27b39e1e9","resolution":{"observed_at":"2026-08-11T19:17:03.174736Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:03.004739Z","title":"D.; Jain, M.; Ghanem, B.; and Snoek, C","venue":null,"work_id":"259f5a1c-cd8d-404f-8025-4adae39fca60","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.844746Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:21fd3269d4d56c31615b8265d1e1a0f27032c5456403d23b5a7c68d8b2377d45","observation_id":"e481414d-6dda-46ef-aa78-523edd7341be","resolution":{"observed_at":"2026-08-11T19:17:03.054742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.863267Z","title":null,"venue":null,"work_id":"1b10987e-c698-4bca-8c82-194797ebf06c","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.864743Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:6155ff46759d639e5b7e9e8a44f5c8efb3140fa6101d0f151c70e58f271d9096","observation_id":"567e279b-854c-4875-969f-897b9faa909f","resolution":{"observed_at":"2026-08-11T19:17:02.866145Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1605.07157","last_updated":"2016-10-17T20:09:56Z","snapshot_observed_at":"2026-08-08T07:55:53.520010Z","submitted_at":"2016-05-23T19:45:55Z","title":"Unsupervised Learning for Physical Interaction through Video Prediction","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1605.07157","snapshot_observed_at":"2026-08-11T19:16:59.885242Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.885242Z"},"links":{"cited_paper":"/paper/1605.07157","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:b62719855aa53d5a1788a0f57b7c99fecfe41395ebd8d27a433c8f1bcabe89c0","observation_id":"96d28f28-444f-43b2-9d9c-2515e07423a8","resolution":{"observed_at":"2026-08-11T19:16:59.885242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.854563Z","title":null,"venue":null,"work_id":"1dc74b79-7b03-42ee-8f81-db4eca0e84a0","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.915969Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:6b504721a1f033c9a3663532559a3874367df6e8f296795c07b8653abdf9acc2","observation_id":"4f19a969-0027-47c4-af91-d563732a6645","resolution":{"observed_at":"2026-08-11T19:17:02.857820Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.798969Z","title":"A.; Vondrick, C.; Pantofaru, C.; Li, Y.; Vijayanarasimhan, S.; Toderici, G.; Ricco, S.; Sukthankar, R.; Schmid, C.; and Malik, J","venue":null,"work_id":"07cafdcf-7681-4c23-828a-3f1203d3e2f1","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.929214Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:c7e83a4aa2ab2da1c6c4fd6cddf91436a55d93cc7c640413e5e10bdbea9b3359","observation_id":"a57e80f0-9e18-4b6f-b727-1e3379c133cb","resolution":{"observed_at":"2026-08-11T19:17:02.808392Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.762964Z","title":null,"venue":null,"work_id":"198dd3aa-3223-436a-8ae4-ff26b05d49dc","year":2017},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.934520Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:fde6db41985191cb0a29ebc77a4f38e83cc9f634070532197a9c42d86a0bf4b2","observation_id":"18cfc2cc-91e2-4c87-a21a-f98de470d29b","resolution":{"observed_at":"2026-08-11T19:17:02.767189Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.754346Z","title":null,"venue":null,"work_id":"bd97e3c8-7368-4aaf-95fb-7e8d75bc0646","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.947667Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:e2014d948e545247326d4843c4138b749b70567f4814ea01323c7a2dc882fab9","observation_id":"676a377b-13eb-48ae-bed8-14dc9fc4924f","resolution":{"observed_at":"2026-08-11T19:17:02.757419Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:16:59.950010Z","title":null,"venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.950010Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:68893e5f8f79d7e598156166a2b7425e700a66bce8d5eae1414a14453d852c6c","observation_id":"519cb96c-8473-47af-b513-88b441999943","resolution":{"observed_at":"2026-08-11T19:16:59.950010Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.730313Z","title":null,"venue":null,"work_id":"051b246f-0f28-4019-bdc8-22450240e563","year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.965837Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:7bf0e8d3f4647d5d3f49cf2324b002392a2f6989f519c5d9454a5bfada734b7c","observation_id":"f6ae9c20-1984-4274-ae1a-4a1586ddce12","resolution":{"observed_at":"2026-08-11T19:17:02.733121Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.721113Z","title":null,"venue":null,"work_id":"66addd0c-4bff-4829-91b1-aee8a7e40765","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.969913Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:bda9e607cb404503e1e93b6698fa12f6761bdc084c845944b2749e1fc8d8f49a","observation_id":"c6a30fe1-3866-449b-8e29-eeee994ba70d","resolution":{"observed_at":"2026-08-11T19:17:02.725182Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.702196Z","title":null,"venue":null,"work_id":"76838447-673c-4b4b-80a0-0110d9132af3","year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.972174Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:6a8a990a009933ecee9e2bbfce0da70381312dfa1eb2741d302620a16b3f2307","observation_id":"00536c44-9d21-4a72-9b04-ef1e188f2c4d","resolution":{"observed_at":"2026-08-11T19:17:02.707583Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1911.06644","last_updated":"2021-10-18T12:53:47Z","snapshot_observed_at":"2026-07-06T08:37:17.482124Z","submitted_at":"2019-11-15T14:09:47Z","title":"You Only Watch Once: A Unified CNN Architecture for Real-Time Spatiotemporal Action Localization","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1911.06644","snapshot_observed_at":"2026-08-11T19:16:59.984438Z","title":"o p \\\"u kl \\","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-11T19:16:59.984438Z"},"links":{"cited_paper":"/paper/1911.06644","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:64848e2ddcf59b5a31333c247e7fe0b801c04ee5c280c057dc2eaeb12078ad5f","observation_id":"69e195b8-e658-44f5-b79e-cc47ee928385","resolution":{"observed_at":"2026-08-11T19:16:59.984438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.06010","last_updated":"2023-11-20T14:26:00Z","snapshot_observed_at":"2026-08-12T12:07:21.936326Z","submitted_at":"2023-06-09T16:27:14Z","title":"A Large-Scale Analysis on Self-Supervised Video Representation Learning","version":2},"cited_work":{"arxiv_id":"2306.06010","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.06010","snapshot_observed_at":"2026-08-11T19:17:01.956122Z","title":"A Large-Scale Analysis on Self-Supervised Video Representation Learning","venue":"cs.CV","work_id":"54397a1a-36b8-4dd8-a27e-e68b531f29d5","year":2023},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.005408Z"},"links":{"cited_paper":"/paper/2306.06010","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:78c6d1e26a0cfba4dbb240bbbf6248687a7b047eec564b53fb2d9b02ba3ad597","observation_id":"f5cb7d9f-37d5-4aa5-bb33-0fb9c730b803","resolution":{"observed_at":"2026-08-11T19:17:01.961590Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.685507Z","title":null,"venue":null,"work_id":"ed94d4b9-601b-42cb-855b-af56145829a5","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.019411Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:014b5489fd316349ae091d4bdfd6216d0707728b95afcea103494fb558972788","observation_id":"4ea0f748-f024-428e-acba-74f63c96e075","resolution":{"observed_at":"2026-08-11T19:17:02.690291Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1610.02242","last_updated":"2017-03-15T14:22:41Z","snapshot_observed_at":"2026-08-01T18:35:12.430501Z","submitted_at":"2016-10-07T12:15:42Z","title":"Temporal Ensembling for Semi-Supervised Learning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1610.02242","snapshot_observed_at":"2026-08-11T19:17:00.054744Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.054744Z"},"links":{"cited_paper":"/paper/1610.02242","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:5557e80d82d952063f907e4cd579cfb331bc7965d07113f2403fe0fc7e7991e0","observation_id":"3cdda4e0-9be4-46b2-b04d-0e1936f8276d","resolution":{"observed_at":"2026-08-11T19:17:00.054744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.667720Z","title":null,"venue":null,"work_id":"45a4ce82-db34-4915-98e9-767d7764a346","year":2013},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.091017Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:4fc9290fad295067bcde21597d82fde3079b7188628bdf78aea5432b620dbb70","observation_id":"2309be5e-c7f6-48e0-a5b4-835e144ee29b","resolution":{"observed_at":"2026-08-11T19:17:02.678162Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2001.04608","last_updated":"2020-08-22T14:45:35Z","snapshot_observed_at":"2026-08-11T08:04:14.425236Z","submitted_at":"2020-01-14T03:29:44Z","title":"Actions as Moving Points","version":3},"cited_work":{"arxiv_id":"2001.04608","doi":null,"metadata_source":"pith","pith_arxiv_id":"2001.04608","snapshot_observed_at":"2026-08-11T19:17:01.893041Z","title":"Actions as Moving Points","venue":"cs.CV","work_id":"bbd3cba1-f58a-4b2f-8251-7b6d107c0786","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.094266Z"},"links":{"cited_paper":"/paper/2001.04608","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:7c7a71faa1e1cf716561150d18cc023d030241a75ce1f1fe172026e385dc6cdb","observation_id":"ea6d16d5-518c-48c9-b32b-6b9f0c137b5e","resolution":{"observed_at":"2026-08-11T19:17:01.905071Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.651726Z","title":"E.; Fu, C.-Y.; and Berg, A","venue":null,"work_id":"57e8396b-f816-4390-916e-3ef8329422b4","year":2016},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.114922Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:efe6867723211fb433943f212c133003c2cbf4599d32c43fc79791a5d664d23f","observation_id":"ba96dec2-1da1-41e9-bb64-e6276f82f434","resolution":{"observed_at":"2026-08-11T19:17:02.657565Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.637330Z","title":null,"venue":null,"work_id":"2a15175f-c61b-49ed-aa3b-a9934e0e4dfc","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.174749Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:e627eea20f5e26e1191ad3eda026142d99d134c94b8a38f0501a33f8bc1a2842","observation_id":"c140c390-0967-40e9-bf9d-050ffbb00f42","resolution":{"observed_at":"2026-08-11T19:17:02.642566Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.622978Z","title":null,"venue":null,"work_id":"26cda347-e48f-45a6-b1b0-3b5e3e0fe5b2","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.207897Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:0f7e2319dd79fd0c0b2885418ba254d207ef247479daec62cf44b45bc409a17f","observation_id":"3894a49a-2b53-47c5-98f5-3a410033089d","resolution":{"observed_at":"2026-08-11T19:17:02.626001Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.614644Z","title":null,"venue":null,"work_id":"82527de8-55a8-4d20-ae94-86d105e8e0d2","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.217909Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:8ec056fd875e715520880d2715a32cf4e9bf1a636d30e72df9dcb4654ed7c533","observation_id":"ebcbc639-71ef-4ddd-a3b1-93095c3d66da","resolution":{"observed_at":"2026-08-11T19:17:02.616883Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.607153Z","title":null,"venue":null,"work_id":"84bdcc89-f322-4bff-a468-febfeb1e9c25","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.235049Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:fcb0aaaa3b1e364bcc5d6c138d64a31a6f05b74a33f4c065c6b82f211be0a7b4","observation_id":"5138a785-93df-4e6e-8ac3-911db9413e85","resolution":{"observed_at":"2026-08-11T19:17:02.609725Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1707.09143","last_updated":"2017-07-28T08:16:34Z","snapshot_observed_at":"2026-07-06T05:53:05.719791Z","submitted_at":"2017-07-28T08:16:34Z","title":"Localizing Actions from Video Labels and Pseudo-Annotations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1707.09143","snapshot_observed_at":"2026-08-11T19:17:00.264741Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.264741Z"},"links":{"cited_paper":"/paper/1707.09143","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:d72fa0cb389d6ba7ff5c0a06c9affee33244c3e015755b33b769d7e1dd78a62e","observation_id":"f4806af6-7b9e-43b9-ac2a-d032804e56a4","resolution":{"observed_at":"2026-08-11T19:17:00.264741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.600156Z","title":null,"venue":null,"work_id":"7139d0cd-afda-48d4-93d1-19e1824751b6","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.294827Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:d860354c05010c31035ff40ed705ab592384b2b041407df28f1d7e7e7777306a","observation_id":"d06ed2af-373e-4672-8c98-0b0503c3a409","resolution":{"observed_at":"2026-08-11T19:17:02.602629Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.591660Z","title":null,"venue":null,"work_id":"ec3ac788-9ed7-4a4d-970a-3420cd3c8a32","year":2024},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.344747Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:7af1907d33cd57c3f44abc34f93cbf2e5875b54413d67f6377983dfa6a49f8d1","observation_id":"7c009b86-4d0e-433d-9f26-4623ef99f1f8","resolution":{"observed_at":"2026-08-11T19:17:02.594662Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:00.370443Z","title":"Z.; Liu, Y.; Shao, J.; and Li, H","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.370443Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:928ca3bb518caf6fba76a1eb1fad22ef06bacf8f89964bae51b4bb40fe5617ff","observation_id":"b7208893-f716-43fc-b68d-64f05761e41e","resolution":{"observed_at":"2026-08-11T19:17:00.370443Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.578621Z","title":null,"venue":null,"work_id":"c1d6e498-5118-4649-bdd1-a77f25184bb0","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.395125Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:6b0ef39d073201fbb900e2810268c3df700cf2b35cc6f25121811504325edc35","observation_id":"6a59208c-ac36-4f64-bf12-54d509df3c6c","resolution":{"observed_at":"2026-08-11T19:17:02.580711Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1507.02672","last_updated":"2015-11-24T09:22:23Z","snapshot_observed_at":"2026-08-10T09:07:51.108739Z","submitted_at":"2015-07-09T19:52:19Z","title":"Semi-Supervised Learning with Ladder Networks","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1507.02672","snapshot_observed_at":"2026-08-11T19:17:00.425676Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.425676Z"},"links":{"cited_paper":"/paper/1507.02672","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:e09b8cf5da9c24436cf5e1883e86359503d8aaa9f8fbacfd81e147ab987fbcc3","observation_id":"4caf57dc-d6be-49b4-abc8-baede9aa0e81","resolution":{"observed_at":"2026-08-11T19:17:00.425676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.572205Z","title":null,"venue":null,"work_id":"4824e98f-320c-4080-af2b-be6013115196","year":2015},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.440512Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:436164dfd8b7b82a00d3acd409f2d42a2fa845b9a136741655d492379b55648b","observation_id":"95691415-e950-410c-9b6a-065da2c0449f","resolution":{"observed_at":"2026-08-11T19:17:02.574391Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.558373Z","title":"N.; Duarte, K.; Rawat, Y","venue":null,"work_id":"fc2f9f96-99ed-4353-a0cf-f63a73de83ce","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.494748Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:3a1db06d1ae07cc7ce2f7c25bdef4a9fa0722b9ee496d0859561ff0cf32e3867","observation_id":"f64626a4-8e5a-4619-81ab-13b46f025d90","resolution":{"observed_at":"2026-08-11T19:17:02.564238Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1505.04597","last_updated":"2015-05-18T11:28:37Z","snapshot_observed_at":"2026-08-06T11:05:16.105361Z","submitted_at":"2015-05-18T11:28:37Z","title":"U-Net: Convolutional Networks for Biomedical Image Segmentation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1505.04597","snapshot_observed_at":"2026-08-11T19:17:00.554745Z","title":null,"venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.554745Z"},"links":{"cited_paper":"/paper/1505.04597","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:8584d64d3938621363f884e821dc9d55e5e668097d0b309a3c6b30e3e47b5cd4","observation_id":"6636afb3-363a-4603-9a51-f053f3379167","resolution":{"observed_at":"2026-08-11T19:17:00.554745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.537767Z","title":null,"venue":null,"work_id":"24756d68-d038-4f1c-a0d6-b569d3785ca7","year":2016},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.585714Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:c36e99add467875c9121850e58099d8682b4b29f72a4991576b0dd8581c77df3","observation_id":"61ce492e-9513-4e75-a1ad-d7c62807284a","resolution":{"observed_at":"2026-08-11T19:17:02.542861Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.528893Z","title":"S.; Saenko, K.; and Das, A","venue":null,"work_id":"37b87442-44ac-428a-a267-8175cfc61857","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.614748Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:c4bbc09c1ce7badd08a6a2081a70ab4fe25cd62022cd912f0fe2594d9edb8fec","observation_id":"efd70d79-42b5-4389-bb89-5f99e7e9965d","resolution":{"observed_at":"2026-08-11T19:17:02.531467Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.520344Z","title":"J.; Kumar, A.; Vyas, S.; and Rawat, Y","venue":null,"work_id":"a2d587a4-5202-4284-b6a1-1774f0d24734","year":2024},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.654744Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:7fbae825aa90ad2ae181260902389125cdab81bf774da9b36d8cded283cfb013","observation_id":"7b272520-ed28-4686-8b85-2f906baa26de","resolution":{"observed_at":"2026-08-11T19:17:02.522490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.513816Z","title":"A.; Cubuk, E","venue":null,"work_id":"5cb3d02a-9b69-47c3-a8ff-3fb767c016f3","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.684746Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:b168c426159098f75e467f0015231436b66ba7a4cc668f39b8e7313f0f900f04","observation_id":"118abe95-0b13-46d9-98f2-68b40ef9d9c5","resolution":{"observed_at":"2026-08-11T19:17:02.516289Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.501299Z","title":null,"venue":null,"work_id":"03c776bd-32cb-446f-9a1e-d55eea69e5f3","year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.724747Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:ebcd18e41b21008c77dc566696d17802ffaff4ee75ba09a9d3de9d30eb6cc625","observation_id":"3fc60b04-e015-4cd2-8595-657a46388ae8","resolution":{"observed_at":"2026-08-11T19:17:02.508324Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1212.0402","last_updated":"2012-12-03T14:45:31Z","snapshot_observed_at":"2026-07-06T03:01:10.229407Z","submitted_at":"2012-12-03T14:45:31Z","title":"UCF101: A Dataset of 101 Human Actions Classes From Videos in The Wild","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1212.0402","snapshot_observed_at":"2026-08-11T19:17:00.764745Z","title":null,"venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.764745Z"},"links":{"cited_paper":"/paper/1212.0402","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:6fad01a0f69373ced499fc15c612caca5b5a277d1cceebefd32268fd1fed3dcb","observation_id":"71e719cc-3a88-4b6a-9189-7ed70eff92ad","resolution":{"observed_at":"2026-08-11T19:17:00.764745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.473956Z","title":null,"venue":null,"work_id":"0a2b218e-b535-4491-903b-2abcc36e6b81","year":2023},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.795381Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:18448bac3a1ccccab718adc100158a598602b8d60046f63142b1beee659ee5b8","observation_id":"e6c0e42d-53b4-4b3f-9b7f-528a3cd68c69","resolution":{"observed_at":"2026-08-11T19:17:02.483479Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.460524Z","title":null,"venue":null,"work_id":"e8e15ce9-312b-47a1-aa77-341ed5736398","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.816932Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:d077c0917ebde815d04f6dc56addcf15397aa37b17aab46617d767503882197a","observation_id":"15665083-40f1-4171-9285-ca9035cf0758","resolution":{"observed_at":"2026-08-11T19:17:02.462920Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.442340Z","title":null,"venue":null,"work_id":"fa1b9e13-d226-401d-bba9-3cce67a8994f","year":2017},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":49,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.828177Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:1e62709df07017ac68d612d85865973aa55a81af4b5da71e2ba3d0fac7010016","observation_id":"f1ee6d6d-eecf-4fde-a41c-280fe55b0d4d","resolution":{"observed_at":"2026-08-11T19:17:02.444968Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.434325Z","title":null,"venue":null,"work_id":"0fde87e2-dc54-48bc-a4d5-6943da42e4f0","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":50,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.832651Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:2d5c492757c2982589fd7d3d0a9ae87e0d8ed4a18cf4fc2e1f16000f03781cf3","observation_id":"53dc3e4d-dce7-49c2-9725-8748fd69db1f","resolution":{"observed_at":"2026-08-11T19:17:02.438082Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.427954Z","title":null,"venue":null,"work_id":"52ba6c43-9518-41dd-be56-ade443f9747f","year":2015},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":51,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.837677Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:d01ad73072a616924d1114f3f61b3473cfe2d9441001d7c62551f69cf81f2ec7","observation_id":"8347ed15-2ccb-4097-972f-e812ffbcb451","resolution":{"observed_at":"2026-08-11T19:17:02.430161Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.15879","last_updated":"2023-03-28T10:47:06Z","snapshot_observed_at":"2026-08-06T13:29:51.918414Z","submitted_at":"2023-03-28T10:47:06Z","title":"STMixer: A One-Stage Sparse Action Detector","version":1},"cited_work":{"arxiv_id":"2303.15879","doi":null,"metadata_source":"pith","pith_arxiv_id":"2303.15879","snapshot_observed_at":"2026-08-11T19:17:01.777117Z","title":"STMixer: A One-Stage Sparse Action Detector","venue":"cs.CV","work_id":"4635a450-1938-4f8c-a023-124d2097e3fc","year":2023},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":52,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.856981Z"},"links":{"cited_paper":"/paper/2303.15879","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:1f0f450900e41adddfef2216790fcf14ccdcfd5e6a186710a3cbe4eeec6bf4ba","observation_id":"cdb533d6-49e2-409e-9d47-1900f40da740","resolution":{"observed_at":"2026-08-11T19:17:01.801875Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.413376Z","title":null,"venue":null,"work_id":"fa292c8b-8b6e-4119-8465-4c2148a93a27","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":53,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.859512Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:32e4202a03a3a37d9c0c7bddf040fb911f2052da8b6e8c9bb2a72bd68ed3fcf4","observation_id":"5c9a1dbd-b254-4f4a-9d52-255af03fd9f0","resolution":{"observed_at":"2026-08-11T19:17:02.419430Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09018","last_updated":"2021-08-06T16:28:39Z","snapshot_observed_at":"2026-07-06T11:20:02.840666Z","submitted_at":"2021-06-16T17:59:30Z","title":"End-to-End Semi-Supervised Object Detection with Soft Teacher","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.09018","snapshot_observed_at":"2026-08-11T19:17:00.861766Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":54,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.861766Z"},"links":{"cited_paper":"/paper/2106.09018","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:10db31c8d71e3c0e548d6414d7ec5213eb2abad5693c6bb3beec08b8c9900d22","observation_id":"98b9a369-bd62-4683-8895-9a7e5eb67052","resolution":{"observed_at":"2026-08-11T19:17:00.861766Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.365389Z","title":null,"venue":null,"work_id":"e3a5da6d-c65d-4cfd-a169-2665ed77ca7c","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":55,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.874768Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:369b666b2bad1727cae7842313e470e0e88ddb675d80171b5d371f421b54b20f","observation_id":"7edcffa5-9fc5-45df-8faa-9675779acf76","resolution":{"observed_at":"2026-08-11T19:17:02.374734Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.00461","last_updated":"2018-09-03T06:16:13Z","snapshot_observed_at":"2026-07-06T06:58:49.066693Z","submitted_at":"2018-09-03T06:16:13Z","title":"YouTube-VOS: Sequence-to-Sequence Video Object Segmentation","version":1},"cited_work":{"arxiv_id":"1809.00461","doi":null,"metadata_source":"pith","pith_arxiv_id":"1809.00461","snapshot_observed_at":"2026-08-11T19:17:01.654750Z","title":"YouTube-VOS: Sequence-to-Sequence Video Object Segmentation","venue":"cs.CV","work_id":"cdf70443-17aa-4838-8f28-91706e968868","year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":56,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.899915Z"},"links":{"cited_paper":"/paper/1809.00461","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:08eff07e9f27a9a4af61cfb19497915d05ae0eebd6a93ee0290d3adba51bfb0a","observation_id":"cf454c68-8a99-46c0-b7f7-79a9448b3578","resolution":{"observed_at":"2026-08-11T19:17:01.675586Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1809.03327","last_updated":"2018-09-06T04:19:45Z","snapshot_observed_at":"2026-07-06T07:00:12.122241Z","submitted_at":"2018-09-06T04:19:45Z","title":"YouTube-VOS: A Large-Scale Video Object Segmentation Benchmark","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.03327","snapshot_observed_at":"2026-08-11T19:17:00.944745Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":57,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.944745Z"},"links":{"cited_paper":"/paper/1809.03327","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:6517b78766b8872dcc5bed22f7b77712026c2e8f7b4a03c89f75d9fe76d06c4d","observation_id":"f57d4a2d-0b4d-4f20-8a83-3d9835524943","resolution":{"observed_at":"2026-08-11T19:17:00.944745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.348044Z","title":null,"venue":null,"work_id":"87a0fae9-7f90-4f7b-8358-1a176f2aa23a","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":58,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:00.974743Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:e9d553b0fb3bc8ce0f987b394fc3e650f498afe87af20a60a290a1a84dd3b034","observation_id":"0a35821e-4817-43b7-884e-94d2f25c3fff","resolution":{"observed_at":"2026-08-11T19:17:02.353353Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2302.06848","last_updated":"2023-06-08T01:49:33Z","snapshot_observed_at":"2026-07-06T14:51:33.651976Z","submitted_at":"2023-02-14T05:52:45Z","title":"YOWOv2: A Stronger yet Efficient Multi-level Detection Framework for Real-time Spatio-temporal Action Detection","version":2},"cited_work":{"arxiv_id":"2302.06848","doi":null,"metadata_source":"pith","pith_arxiv_id":"2302.06848","snapshot_observed_at":"2026-08-11T19:17:01.504739Z","title":"YOWOv2: A Stronger yet Efficient Multi-level Detection Framework for Real-time Spatio-temporal Action Detection","venue":"cs.CV","work_id":"42236e40-06cf-48b6-9d79-10e28d7ced84","year":2023},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":59,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.014748Z"},"links":{"cited_paper":"/paper/2302.06848","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:f4192ca5488b0a359ddce424b2d62ea7ed71857935fe1a381fd6e8d0f416afd6","observation_id":"bf467960-7581-45a8-912b-d1cec67c7bf2","resolution":{"observed_at":"2026-08-11T19:17:01.539486Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.322672Z","title":"S.; and Kautz, J","venue":null,"work_id":"89b0481e-70cd-4833-9f03-40290b90b40c","year":2019},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":60,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.056911Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:e3b34b44d466e43f45b0a783bc70ec989c8b09041ad402bc60901e0f040bef3f","observation_id":"80a04c4d-bdab-4d7f-9148-1ff9ad54b495","resolution":{"observed_at":"2026-08-11T19:17:02.334744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.303847Z","title":null,"venue":null,"work_id":"054c217b-6758-4bc1-acd7-4932af7e81e4","year":2017},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":61,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.084745Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:79437c9e81da6e9f4ad598f76e9d246b8f4dfbe86e917d6a2863a2229a2ba005","observation_id":"c03ee336-b0a3-4898-8331-c25341d05e85","resolution":{"observed_at":"2026-08-11T19:17:02.310686Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.265071Z","title":null,"venue":null,"work_id":"e920b2e8-d121-4ea0-937b-db853bb4864b","year":2020},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":62,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.118942Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:ef665a4105bbcce088ec19e4112adb991a0dbae9355bf1aaf23314ce99916b49","observation_id":"d88ca153-7d88-4460-b400-c4e76e82c638","resolution":{"observed_at":"2026-08-11T19:17:02.294975Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2104.00969","last_updated":"2022-05-10T07:39:03Z","snapshot_observed_at":"2026-07-06T10:56:01.047350Z","submitted_at":"2021-04-02T10:21:22Z","title":"TubeR: Tubelet Transformer for Video Action Detection","version":5},"cited_work":{"arxiv_id":"2104.00969","doi":null,"metadata_source":"pith","pith_arxiv_id":"2104.00969","snapshot_observed_at":"2026-08-11T19:17:01.364844Z","title":"TubeR: Tubelet Transformer for Video Action Detection","venue":"cs.CV","work_id":"f40d9c70-3634-40c8-ac39-0f655ba8e38d","year":2021},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":63,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.121437Z"},"links":{"cited_paper":"/paper/2104.00969","citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:fec0a383396abd92512ab17b91094071790dab5167aaf90a85e11ce719ec1b69","observation_id":"5bb50453-7da9-46d2-aeda-a8717a5edc93","resolution":{"observed_at":"2026-08-11T19:17:01.385720Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:02.225127Z","title":null,"venue":null,"work_id":"7e8694a8-6151-4448-aaec-aa069f7696e4","year":2022},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":64,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.142808Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:5c51d6ebf9026fc5cf6ca1723c7831b9c1defcac72aa5f03f4732b173af1caa8","observation_id":"ae50adae-f221-4e44-933f-347360cdca96","resolution":{"observed_at":"2026-08-11T19:17:02.246546Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:01.186876Z","title":", \" * write output.state after.block = add.period write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":65,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.186876Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:20c55d50a8e6b167af25a13edbdcdd233e4a6a45b10db0ecb4dc4db800d2ab5d","observation_id":"bc2a939a-1f71-440a-884f-1aa5a4471974","resolution":{"observed_at":"2026-08-11T19:17:01.186876Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T19:17:01.216603Z","title":"write newline","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection","version":2},"reference_index":66,"source":"arxiv_source","source_observed_at":"2026-08-11T19:17:01.216603Z"},"links":{"citing_paper":"/paper/2412.07072"},"observation_digest":"sha256:a45d06b25ac9830cf792149a84d117c24abdc42845e22a4809030bfd36df9f16","observation_id":"587515b6-f6a6-4b59-982e-630e0a980598","resolution":{"observed_at":"2026-08-11T19:17:01.216603Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.07072","last_updated":"2024-12-23T01:39:48Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T19:07:51.846481Z","submitted_at":"2024-12-10T00:25:33Z","title":"Stable Mean Teacher for Semi-supervised Video Action Detection"},"reference_resolution":{"displayed":66,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":49,"verified_exact":7,"verified_fuzzy":10},"total_outbound_references":66},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 66 of 66 outbound references and 0 inbound Pith citation observations for arXiv:2412.07072."}