{"as_of":"2026-08-12T18:43:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f6c7044cf79d31904892cb6289030a9f62e4fc424272e545b6dba27ffb464a51","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T10:37:19.977230Z","state":"measured"},{"denominator":35,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":35,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-12T06:34:41.77262+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2412.16446/citation-record","integrity":"/paper/2412.16446/integrity","json":"/paper/2412.16446/citation-record.json","paper":"/paper/2412.16446"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.585696Z","title":"Findings from WeProtect global alliance/ technology coalition survey of technology companies","venue":null,"work_id":"8333e116-ab85-4558-91e5-85b1a81f1a63","year":null},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.824734Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:c90c7b7451b790283784d0f6da37cd4950f7ddfea1272e3d998edb5dda245219","observation_id":"a3247c8f-959b-49a7-8e3b-b584f6c791e6","resolution":{"observed_at":"2026-08-11T10:37:20.590035Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.571820Z","title":"The tale of Telegram governance: When the rule of thumb fails,","venue":null,"work_id":"038b4b50-fc84-4426-ae7d-0c3ba6341ba3","year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.829751Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:c2dc209556e0ac2c57569778f1bd9c25003140573dac33e8f301a71fd5bd766c","observation_id":"93612713-5a75-499e-9b9c-f6c04ed05ba9","resolution":{"observed_at":"2026-08-11T10:37:20.576665Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.558365Z","title":"Detecting child sexual abuse material: A comprehensive survey,","venue":null,"work_id":"1df57b14-a09d-483c-9a70-6207b96ec0d7","year":2020},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.834465Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:0d23c6eb589af217bd953e1b9ee28de7d9c0f5fd032f436fed5a1b0dc98208a1","observation_id":"3d139b80-6b47-4932-a132-105c0127f3f6","resolution":{"observed_at":"2026-08-11T10:37:20.562766Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.542881Z","title":"Smart content recognition from images using a mixture of convolutional neural networks,","venue":null,"work_id":"ad153fd0-684b-4583-93e0-6e850a8cbd17","year":2017},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.839109Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:aba9775b012404d5298656a9e489660f12930c41e2dcd11a5b82519192c7eb04","observation_id":"dedefd7a-479c-4c57-abae-50b524c24806","resolution":{"observed_at":"2026-08-11T10:37:20.548476Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"dataset/1345648","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.173025Z","title":"20k nudity dataset,","venue":null,"work_id":"9d192341-df86-41f8-8146-b8052d611e1c","year":2020},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.843632Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:63a29e1c8f8dc9d4f379b47d2fc91468a81c27082e2ebe5261705593ecb3594f","observation_id":"07ebffce-6460-4b8a-a787-f4e18e7ebd20","resolution":{"observed_at":"2026-08-11T10:37:20.180497Z","resolver_source":"raw_fallback","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.528983Z","title":"AttM- CNN: Attention and metric learning based CNN for pornography, age and child sexual abuse (CSA) detection in images,","venue":null,"work_id":"7cacc3c8-a570-4383-b9cf-d3c31967b1dc","year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.848013Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:dab0602963c9f081a3df27cbbf8fda6b773baf227d33b333107258b7b5f3a263","observation_id":"1e6a80df-73c7-4ad2-85c9-5c17aec191f8","resolution":{"observed_at":"2026-08-11T10:37:20.533728Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.513978Z","title":"Description of the neural network based on AB/DL pictures. Possible implications for forensic sexology,","venue":null,"work_id":"21225220-a299-47ef-9cc6-799930c7da55","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.852580Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:4d4113b94c12d28274e8352e1afac6a7b821a11d36303160eb57bbba8f02e90c","observation_id":"e823b342-7dda-4768-a42f-4d5fb91e7bcd","resolution":{"observed_at":"2026-08-11T10:37:20.519350Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.498263Z","title":"LSPD: A large-scale pornographic dataset for detection and classification,","venue":null,"work_id":"e8407b7f-67be-4c32-8fae-123bbb15071d","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.857381Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:a834d0528aae16ec978b091b67cd15da260d970ebe7eb53d5898e4f29fecf0bd","observation_id":"725679e3-c2f1-4203-ac36-cf55d46cd546","resolution":{"observed_at":"2026-08-11T10:37:20.503920Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.482135Z","title":null,"venue":null,"work_id":"09eef013-2f76-47d9-a00b-1a9b39e87491","year":null},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.861365Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:ec9d5f95b178f71be6238ce6f6049914ab998e5ad4453a4f0d3bb63fb34ec668","observation_id":"b0e23209-dd61-431b-81cf-380d73dd6919","resolution":{"observed_at":"2026-08-11T10:37:20.487588Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.467644Z","title":"Detecting pornographic images by localizing skin rois,","venue":null,"work_id":"079cd5f8-ccdf-44f6-ba0f-6e9f1e4a7f35","year":2013},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.865681Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:324f892035ccfbe3a761edd0740f7ebac2635491ec8cc5dbb8ad7972a7d4fc27","observation_id":"275d7f96-4e65-4209-adeb-05c41a44f927","resolution":{"observed_at":"2026-08-11T10:37:20.472012Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.452491Z","title":"NuDetective: A Forensic Tool to Help Combat Child Pornography through Automatic Nudity Detection,","venue":null,"work_id":"03dde329-7212-4ea7-a6ab-85627a0855a5","year":2010},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.869443Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:2af65dbd00612eb53e59ca3ac652fff77907f1094b1b4551786e05f1a399aa53","observation_id":"fee19391-3a80-4351-8615-e122190b463f","resolution":{"observed_at":"2026-08-11T10:37:20.456656Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.439243Z","title":"Open nsfw model,","venue":null,"work_id":"ccae2543-7b6e-43f7-87d6-b5d4c483a75a","year":2023},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.873444Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:3bb2491911438cd1271850a009acfcdfceeb6e2efd961d6c3e85df8aef3f9835","observation_id":"061454a2-7421-44bd-a022-7fcacb5e3c8e","resolution":{"observed_at":"2026-08-11T10:37:20.443407Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.423991Z","title":"Laying foundations for effective machine learning in law enforce- ment. Majura – A labelling schema for child exploitation materials,","venue":null,"work_id":"8a8fef91-8817-4a5c-a76a-1a0436ecee72","year":2018},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.877368Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:1ff161d8bb33a1b93a44b0ad9c3ee8a636b4590c54e6901aac81806128d0777f","observation_id":"d5f4db3f-303e-4547-b344-a0b95be9bf8c","resolution":{"observed_at":"2026-08-11T10:37:20.429531Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.0473","last_updated":"2016-05-19T21:53:22Z","snapshot_observed_at":"2026-08-12T12:07:33.202888Z","submitted_at":"2014-09-01T16:33:02Z","title":"Neural Machine Translation by Jointly Learning to Align and Translate","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.0473","snapshot_observed_at":"2026-08-11T10:37:19.881081Z","title":"Neural machine trans- lation by jointly learning to align and translate,","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.881081Z"},"links":{"cited_paper":"/paper/1409.0473","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:7c3e10d26774d49c9a5f0e913b3ee269319cd9be00f7304c4197884b41d2e132","observation_id":"2738a141-98ee-4173-aad6-281e53a34d06","resolution":{"observed_at":"2026-08-11T10:37:19.881081Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1601.06823","last_updated":"2016-01-25T21:54:02Z","snapshot_observed_at":"2026-07-06T04:44:02.382837Z","submitted_at":"2016-01-25T21:54:02Z","title":"Survey on the attention based RNN model and its applications in computer vision","version":1},"cited_work":{"arxiv_id":"1601.06823","doi":null,"metadata_source":"pith","pith_arxiv_id":"1601.06823","snapshot_observed_at":"2026-08-11T10:37:20.080659Z","title":"Survey on the attention based RNN model and its applications in computer vision","venue":"cs.CV","work_id":"23424704-e26a-440f-8ffa-c39638021345","year":2016},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.885023Z"},"links":{"cited_paper":"/paper/1601.06823","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:a01859fda58fddfe023d813fc7e82043cf564fbef893c5db7955868e008ed725","observation_id":"ca7ea071-2fa1-4600-ac11-9a01e9b04636","resolution":{"observed_at":"2026-08-11T10:37:20.088055Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1705.06950","last_updated":"2017-05-19T12:07:01Z","snapshot_observed_at":"2026-08-08T17:46:50.107463Z","submitted_at":"2017-05-19T12:07:01Z","title":"The Kinetics Human Action Video Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.06950","snapshot_observed_at":"2026-08-11T10:37:19.888909Z","title":"The kinetics human action video dataset,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.888909Z"},"links":{"cited_paper":"/paper/1705.06950","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:0ae389ef2b847d0eaab9da806cccac437ad38c6a3926f5a2cec5b6f2d694f602","observation_id":"5db4cb8a-494b-46fc-ad12-514e57ff39f4","resolution":{"observed_at":"2026-08-11T10:37:19.888909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.409290Z","title":"The “something something","venue":null,"work_id":"7a88ad9a-d956-45cf-96b7-d2dda9ab6330","year":2017},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.893297Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:b21984216b86075179acb61062c171c087f7b60617faacf2a53e1bb5eabe620a","observation_id":"755b89b8-1194-42f0-b51e-774c19727d60","resolution":{"observed_at":"2026-08-11T10:37:20.413802Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:19.897311Z","title":"Multimodal learning with trans- formers: A survey,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.897311Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:24d62cbb4780d68ec7bd13c9a8585249178a6f91c1069e9558cd23813d411895","observation_id":"6477ee2c-bc56-4763-92a7-6c1aa4fca996","resolution":{"observed_at":"2026-08-11T10:37:19.897311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.384156Z","title":"Frozen CLIP models are efficient video learners,","venue":null,"work_id":"cc171823-5227-4f7d-9a67-cd9154538d29","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.901198Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:aa34a1af422212f3ac7d700df14fb2f6d58613f99626a38e40a702d08b393474","observation_id":"b75aecde-cf7e-4111-be61-bfa67dfaf42d","resolution":{"observed_at":"2026-08-11T10:37:20.388758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.369759Z","title":"VideoMAE: Masked autoencoders are data-efficient learners for self-supervised video pre- training,","venue":null,"work_id":"6f206b1c-cda1-4489-96aa-3964faadc588","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.905164Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:929a47c8ef349ec3c7ce2879c152de7d47cc6ef94aa21cb38769178b74cf81af","observation_id":"bf12f670-a356-47c9-bd56-039b168bb1f6","resolution":{"observed_at":"2026-08-11T10:37:20.374744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2102.05095","last_updated":"2021-06-09T14:48:13Z","snapshot_observed_at":"2026-08-09T19:37:59.145976Z","submitted_at":"2021-02-09T19:49:33Z","title":"Is Space-Time Attention All You Need for Video Understanding?","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2102.05095","snapshot_observed_at":"2026-08-11T10:37:19.909396Z","title":"Is space-time attention all you need for video understanding?","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.909396Z"},"links":{"cited_paper":"/paper/2102.05095","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:8643c43174abca698c968336b087b97d4d0f759242881989c72a9ab641f658f6","observation_id":"d766ce6d-4c5f-40be-8d5d-1431e86b02eb","resolution":{"observed_at":"2026-08-11T10:37:19.909396Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.12993","last_updated":"2021-11-25T10:01:05Z","snapshot_observed_at":"2026-07-06T12:12:06.958305Z","submitted_at":"2021-11-25T10:01:05Z","title":"PolyViT: Co-training Vision Transformers on Images, Videos and Audio","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.12993","snapshot_observed_at":"2026-08-11T10:37:19.914676Z","title":"PolyViT: Co-training vision transform- ers on images, videos and audio,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.914676Z"},"links":{"cited_paper":"/paper/2111.12993","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:0d13f8c937a83bc509b190cdfa5ef3a24b7499392a5b67392aac5c7b5d741f3e","observation_id":"54c9698f-6890-46eb-becd-a9439c9e4701","resolution":{"observed_at":"2026-08-11T10:37:19.914676Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.353427Z","title":"Omnimae: Single model masked pretraining on images and videos,","venue":null,"work_id":"d89d2c86-7690-4608-84b9-967a5cb10fe2","year":2023},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.919303Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:f646c93c67b561221630af8cf7412aa484b9b2e0e911e0aebd9b7790fe061a7c","observation_id":"d1c46bea-02dc-4088-a560-d39b6b25ea66","resolution":{"observed_at":"2026-08-11T10:37:20.359371Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.336806Z","title":"Omnivore: A single model for many visual modalities,","venue":null,"work_id":"cc9461ef-0a7b-4a29-ab5b-49d9fa00ade0","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.923664Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:f0dabbf2f59b6a9cdac02766045b75a115ee7285c0a9a746755cb61e9099b548","observation_id":"ca03eb9b-1a15-4b0a-a9dc-4fe64b80c01b","resolution":{"observed_at":"2026-08-11T10:37:20.342848Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2206.09852","last_updated":"2022-06-20T15:31:13Z","snapshot_observed_at":"2026-08-07T22:31:22.587774Z","submitted_at":"2022-06-20T15:31:13Z","title":"M&M Mix: A Multimodal Multiview Transformer Ensemble","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2206.09852","snapshot_observed_at":"2026-08-11T10:37:19.928139Z","title":"M&M mix: A multimodal multiview transformer ensemble,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.928139Z"},"links":{"cited_paper":"/paper/2206.09852","citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:eee0bff7f608e98504c2ab8fc8caedf25f10de5b2e1fe54885178b8d2196d776","observation_id":"aa71f67d-3c31-43f1-8f6d-432f80907d63","resolution":{"observed_at":"2026-08-11T10:37:19.928139Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.319569Z","title":"MultiMAE: Multi-modal multi-task masked autoencoders,","venue":null,"work_id":"ebb1851b-f978-4ebf-bf8c-a2aa05f86473","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.933264Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:21bd5af8a3db8d0680fb35cde4352f9ae00121174ec25ef2c867ad5118301307","observation_id":"5aaa08d9-12da-44e2-9225-2e1a0f4b434e","resolution":{"observed_at":"2026-08-11T10:37:20.325566Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:19.937968Z","title":"Video swin transformer,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.937968Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:bf3cc3f4ede00d5835271ec81ca0181eb132ba33c3edb3f45a8c8b9730061664","observation_id":"790da5fd-1fa7-4c0d-be08-ddd584149612","resolution":{"observed_at":"2026-08-11T10:37:19.937968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.292514Z","title":"BEVT: BERT pretraining of video transform- ers,","venue":null,"work_id":"f8df130f-826b-432b-a115-3181acb7c648","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.942883Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:8e1dcc371c8b7de0b40015dca1f9db3e0b829cec35c398b237474c5d6887d7e9","observation_id":"dbf9293b-db3f-483b-98cd-4e59398db252","resolution":{"observed_at":"2026-08-11T10:37:20.298900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.275734Z","title":"Attention is all you need,","venue":null,"work_id":"210f69cc-a6af-4b28-aaf4-ba9d6619987e","year":2017},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.947832Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:39d9897b7dd546673d0c15048d5be7382737e51547f5fe88974b6f1046b8675a","observation_id":"41d996c0-5fb5-4e87-a7a6-47f6a52e68c2","resolution":{"observed_at":"2026-08-11T10:37:20.281089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:19.953563Z","title":"An image is worth 16x16 words: Transformers for image recognition at scale,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.953563Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:dd09dc518478179262557b042202151b4da0e436ede2301d128a742c2ddced42","observation_id":"bfac9bde-7f4b-49ab-866a-e3c508af8b25","resolution":{"observed_at":"2026-08-11T10:37:19.953563Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:19.958117Z","title":"Swin transformer: Hierarchical vision transformer using shifted windows,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.958117Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:d210a023858fdc68e83ee4f6f6f144ea82a7de10f1d4ab806b0223c445e3a9d2","observation_id":"5c48f9d8-efd4-4a6b-948e-a2e6adefd456","resolution":{"observed_at":"2026-08-11T10:37:19.958117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.237774Z","title":"Fast vision transformers with HiLo at- tention,","venue":null,"work_id":"4a2b672d-f25b-49fc-9688-2f17a5c79912","year":2022},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.962272Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:7b09a7af1101cf3a290b3b7e0f13345be842369968d8ee83ab05023b52ec7584","observation_id":"7be411ab-43b3-414e-aa24-e33a47363ac2","resolution":{"observed_at":"2026-08-11T10:37:20.243234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.221984Z","title":"State-of-the-art in nudity classification: A comparative analysis,","venue":null,"work_id":"38fc7ab6-2c03-4a73-8464-a7808475c481","year":2023},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.968555Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:ad25639157afd0b8f3dbbdcc560dc8405da2590e3733667bb9c30deb6df5638c","observation_id":"352f6087-b9a7-46c6-ba11-4eefa851e2c7","resolution":{"observed_at":"2026-08-11T10:37:20.227175Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.205196Z","title":"The Bumble’s private detector model","venue":null,"work_id":"2aab2931-ae40-4c4b-ba4c-31c6d094eb34","year":null},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.972883Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:2d11bdef3f786768873100b976d8dc45603c7a01bb088e31480faacf204b398d","observation_id":"4279de66-d7ea-4b40-a2c3-8e65d9416397","resolution":{"observed_at":"2026-08-11T10:37:20.210155Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T10:37:20.189943Z","title":"EfficientNet: Rethinking model scaling for con- volutional neural networks,","venue":null,"work_id":"22c07fe3-5b6c-4bcd-b607-1278f2e073fb","year":2019},"citing_paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-11T10:37:19.977230Z"},"links":{"citing_paper":"/paper/2412.16446"},"observation_digest":"sha256:297dac19cb0e80f31404a21320594bdb27d54d914d196e9ad3617c5546343c16","observation_id":"b35b030c-7f1d-4ef9-83c8-b7a96553033e","resolution":{"observed_at":"2026-08-11T10:37:20.194560Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-12T06:34:41.77262+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2412.16446","last_updated":"2024-12-21T02:34:24Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-11T10:32:47.306148Z","submitted_at":"2024-12-21T02:34:24Z","title":"Sensitive Image Classification by Vision Transformers"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":2,"verified_fuzzy":23},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-12T06:34:41.77262+00:00","source":"crossref"},{"observed_at":"2026-08-12T06:34:36.333875+00:00","source":"retraction_watch"}],"thesis":"As of 12 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 0 inbound Pith citation observations for arXiv:2412.16446."}