{"as_of":"2026-08-09T02:10:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:69031b0fdf052776baec4d89d39d5a2c24d5172ff00e42db09ed1e503ca503cb","coverage":[{"denominator":49,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":49,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T13:44:02.957029Z","state":"measured"},{"denominator":49,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":49,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2502.07138/citation-record","integrity":"/paper/2502.07138/integrity","json":"/paper/2502.07138/citation-record.json","paper":"/paper/2502.07138"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.551998Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.551998Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:14d4298c7df61748d1d791539d6322def0e2bfd9d68ac8c4ce44828a53033e07","observation_id":"85109b7e-b75c-48b8-86af-c0ffcafd75b1","resolution":{"observed_at":"2026-08-08T13:44:02.551998Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.879256Z","title":null,"venue":null,"work_id":"457b7f77-df00-4983-b0b4-a3935082aee9","year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.562650Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:311bd299e6a1f773382261cbeccad96c78bd70f6e0efd4cbab49ab3cc695d34c","observation_id":"f877a3b5-e74c-4a42-ae81-fedc8f34b293","resolution":{"observed_at":"2026-08-08T13:44:03.884482Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01390","last_updated":"2023-08-07T17:53:09Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-08-02T19:10:23Z","title":"OpenFlamingo: An Open-Source Framework for Training Large Autoregressive Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01390","snapshot_observed_at":"2026-08-08T13:44:02.568136Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.568136Z"},"links":{"cited_paper":"/paper/2308.01390","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:bc58db98f9d763bdba8b4578582117e417a63ec5559d1cbe90c16f3f0d4e7407","observation_id":"56d4ded1-5fcb-4c72-a63c-d0a94ebb1992","resolution":{"observed_at":"2026-08-08T13:44:02.568136Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.863843Z","title":null,"venue":null,"work_id":"77745273-0f3b-4fc6-ae52-bff711f613ad","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.573571Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:3a63ce5423fedc1de051095ddfbcf887c2ce7d57728c00b06f22ea8ca2f61079","observation_id":"c3afa1f1-a48a-46d0-a592-bf4dde694a99","resolution":{"observed_at":"2026-08-08T13:44:03.868561Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.578371Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.578371Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:5b69c23f271f088850919b45cabf941feba8f1a222f60d83d1512a0c601d8ef5","observation_id":"55db15f7-582a-455b-bb6a-845bc7897ba6","resolution":{"observed_at":"2026-08-08T13:44:02.578371Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.837820Z","title":null,"venue":null,"work_id":"c1699a98-5e1d-411d-895d-61a75a68c0e3","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.618676Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:1225c2d0bd53c67c3559a10ed5ac71ecc146f9b635276be88bdf43511f9e6ce4","observation_id":"123c028b-b301-4130-8b33-4d3c033d0a11","resolution":{"observed_at":"2026-08-08T13:44:03.842966Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.821658Z","title":null,"venue":null,"work_id":"63876fb7-833e-4513-81f3-ec8025cc8a49","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.671810Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:2b6c94316029d06993bb9436277b619307f045b73e7662addda841fcc4036306","observation_id":"e303fed2-763a-4ba9-93bc-5049baaaaa9c","resolution":{"observed_at":"2026-08-08T13:44:03.826594Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.806531Z","title":null,"venue":null,"work_id":"1df183f7-4fb6-47b6-8a8b-6d3735c4f411","year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.689677Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:f3065c1158272cec418de8ee7fee4dc4a4f7e5ab82de5cf346789a6486fb8782","observation_id":"65d35e3a-6efb-46e0-ab66-c95a1b169c70","resolution":{"observed_at":"2026-08-08T13:44:03.811265Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.791154Z","title":null,"venue":null,"work_id":"13e948a0-43c5-42bd-b982-f2eb9fa43a5a","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.702192Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:f7a5e7875a8b0b583596ac603b3293c63ad51e334691d2e044046f9969a77a74","observation_id":"9f7517d0-6759-445c-89a4-e8c3605badb0","resolution":{"observed_at":"2026-08-08T13:44:03.796009Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.776300Z","title":null,"venue":null,"work_id":"984c47b2-a686-497e-85bb-08ef8fe5c83a","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.711073Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:3982eb364bb894efb0ee36294038b72e12996c15f64b205f978a6b53b62dfb29","observation_id":"7a748ef9-4421-4994-8fd3-fe5660a78f55","resolution":{"observed_at":"2026-08-08T13:44:03.780842Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.761584Z","title":null,"venue":null,"work_id":"dbda764c-a54c-4697-95a3-3785c5684e16","year":2021},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.725708Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:4fdb6fdc25b5614bbdb29fc5e11d466f82565152ed30e6719a07e6e17244858b","observation_id":"4c94d001-636e-478e-bf0c-b839bfbfae5e","resolution":{"observed_at":"2026-08-08T13:44:03.766471Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.750318Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.750318Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:2aaa74864c30ec5b8d95be8ce194b23324510ce36288c7ed25f2923f49954835","observation_id":"e8019a53-9fe2-4b69-b34c-3a1445fa719e","resolution":{"observed_at":"2026-08-08T13:44:02.750318Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.736959Z","title":null,"venue":null,"work_id":"d0627e4d-32b8-4b92-8596-8688f4a98ba5","year":1980},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.769381Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:f9e9cf5097a7626de96a049c8d99ebe14278abff04a8464589d05298148b6b7e","observation_id":"a6795801-d1e1-4a85-9160-e32be87e5368","resolution":{"observed_at":"2026-08-08T13:44:03.742710Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.721711Z","title":null,"venue":null,"work_id":"d7ebbad4-f222-4860-8de2-c7d5ce7f0e54","year":null},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.785147Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:5fa9497ef825f818f6cceb8391e294004dc9f016cd88ca9d4ca98fc25e308f39","observation_id":"34897c64-da11-4c2d-b803-ff875df3de98","resolution":{"observed_at":"2026-08-08T13:44:03.726439Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1810.04805","last_updated":"2019-05-24T20:37:26Z","snapshot_observed_at":"2026-07-30T09:12:38.100527Z","submitted_at":"2018-10-11T00:50:01Z","title":"BERT: Pre-training of Deep Bidirectional Transformers for Language Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1810.04805","snapshot_observed_at":"2026-08-08T13:44:02.801532Z","title":null,"venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.801532Z"},"links":{"cited_paper":"/paper/1810.04805","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:79808b81e395749f30e5c3fab362986d97842164168c5efb0489234f6f1ee608","observation_id":"9e24a7bf-6ee8-4dd7-a237-b677d2403680","resolution":{"observed_at":"2026-08-08T13:44:02.801532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-08T13:44:02.806554Z","title":null,"venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.806554Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:6c1c1d698167b6e2eeb25dfdac276d017615d7d20c83f13091b0b33ae54bb387","observation_id":"913c29fb-8b41-45e9-a2b1-7575e6f72fd9","resolution":{"observed_at":"2026-08-08T13:44:02.806554Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.811364Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.811364Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:3883d558b4bb6ce977f393282b00c9e038dbaa1dc8a95472cf6b1792e751cb64","observation_id":"1ea16036-65fd-419d-8505-af763fc1d2d8","resolution":{"observed_at":"2026-08-08T13:44:02.811364Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.686969Z","title":null,"venue":null,"work_id":"d7cda7ab-f06c-4c47-82f1-592d8fc63968","year":2018},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.821685Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:46ec9f0a23f25e89516105a51f76911dbbb36fcbc2c2d92d45da9c80d968e07a","observation_id":"cda2cce9-24c1-430b-ba1e-32bb0214a1fa","resolution":{"observed_at":"2026-08-08T13:44:03.691689Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.672118Z","title":null,"venue":null,"work_id":"5384979d-cf8e-47c7-9e5f-145f17f7e2c4","year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.826428Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:df54b0325db80fd8a9dfe21c18bfffa51ac2a2ebc340e63ea51b5d6dd657e277","observation_id":"001f89de-9f57-4112-bb2d-04735d61e784","resolution":{"observed_at":"2026-08-08T13:44:03.676814Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.656815Z","title":null,"venue":null,"work_id":"7136279a-5775-4843-8ea3-ce7d1657bc8e","year":2018},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.831014Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:fd20d7e9b3504b48c9a21c29226bea8f8fbcf4cf004500e2106b18fd009ee815","observation_id":"88ce3ce4-91ec-471d-82d8-7f9fe995c04b","resolution":{"observed_at":"2026-08-08T13:44:03.661772Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2305.17678","last_updated":"2023-06-19T17:07:33Z","snapshot_observed_at":"2026-08-03T16:33:40.847972Z","submitted_at":"2023-05-28T10:02:59Z","title":"Decoding the Underlying Meaning of Multimodal Hateful Memes","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.17678","snapshot_observed_at":"2026-08-08T13:44:02.835739Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.835739Z"},"links":{"cited_paper":"/paper/2305.17678","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:363c343d8ae85cbc128963fd4d4110fcea4bdf3a7d6d2d3bacc39843a60d5d9b","observation_id":"1832bbf7-b811-4a47-a6dc-281a70ee6dba","resolution":{"observed_at":"2026-08-08T13:44:02.835739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.840786Z","title":null,"venue":null,"work_id":null,"year":1997},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.840786Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:5d6374d7260044027049644fd8ded542090a33c12891252a4716730662ce41a3","observation_id":"97822297-1269-49a8-9b7c-3d0493aae1c4","resolution":{"observed_at":"2026-08-08T13:44:02.840786Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03052","last_updated":"2024-04-05T04:33:23Z","snapshot_observed_at":"2026-07-06T16:57:26.338676Z","submitted_at":"2023-12-05T18:58:37Z","title":"Visual Program Distillation: Distilling Tools and Programmatic Reasoning into Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03052","snapshot_observed_at":"2026-08-08T13:44:02.845652Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.845652Z"},"links":{"cited_paper":"/paper/2312.03052","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:d0b5661f4825dbd4651b0bd9252424f90c08a04871c1942cb1c98b3f684c089d","observation_id":"b7a6cb1d-b927-4521-b56a-e22203e74c63","resolution":{"observed_at":"2026-08-08T13:44:02.845652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21004","last_updated":"2025-01-21T05:31:45Z","snapshot_observed_at":"2026-08-07T20:06:51.762641Z","submitted_at":"2024-07-30T17:51:44Z","title":"Evolver: Chain-of-Evolution Prompting to Boost Large Multimodal Models for Hateful Meme Detection","version":3},"cited_work":{"arxiv_id":"2407.21004","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.21004","snapshot_observed_at":"2026-08-08T13:44:03.359925Z","title":"Evolver: Chain-of-Evolution Prompting to Boost Large Multimodal Models for Hateful Meme Detection","venue":"cs.CL","work_id":"7ce36e7d-43eb-4fae-a3e6-c096a28b1dbe","year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.850643Z"},"links":{"cited_paper":"/paper/2407.21004","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:bed411e4403a17c7158bffb83e2667188d9a1bb1eff510d7d5360ef7d4f85f37","observation_id":"3519af7b-a9f0-44b7-98c1-507786aa7f07","resolution":{"observed_at":"2026-08-08T13:44:03.365281Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.631621Z","title":null,"venue":null,"work_id":"8af39951-aa1a-4ee4-8281-db3ea7467aff","year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.855572Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:2fde7298036f4b7b2bf89bf7f27374e69833c8c6e2540750b08cbb36e1d807b2","observation_id":"4ff5070d-f043-4e45-b7f8-756edf507bb4","resolution":{"observed_at":"2026-08-08T13:44:03.636431Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.05916","last_updated":"2022-10-17T10:29:03Z","snapshot_observed_at":"2026-07-06T14:04:01.312283Z","submitted_at":"2022-10-12T04:34:54Z","title":"Hate-CLIPper: Multimodal Hateful Meme Classification based on Cross-modal Interaction of CLIP Features","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.05916","snapshot_observed_at":"2026-08-08T13:44:02.860094Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.860094Z"},"links":{"cited_paper":"/paper/2210.05916","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:158a02ee405eea88c2aa137a03faf1f2adf33f57e78ca1af3ce4e2fe03f5e000","observation_id":"96507c6d-3b0b-4247-be87-f9f09da298b9","resolution":{"observed_at":"2026-08-08T13:44:02.860094Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1910.13461","last_updated":"2019-10-29T18:01:00Z","snapshot_observed_at":"2026-07-06T08:33:12.534026Z","submitted_at":"2019-10-29T18:01:00Z","title":"BART: Denoising Sequence-to-Sequence Pre-training for Natural Language Generation, Translation, and Comprehension","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1910.13461","snapshot_observed_at":"2026-08-08T13:44:02.865032Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.865032Z"},"links":{"cited_paper":"/paper/1910.13461","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:b893d974d16f4d936b8a92debba079cd617e1224dfafde0bc6e052ee8f7967ab","observation_id":"35a75c43-db51-430b-b713-dbad731dc6b2","resolution":{"observed_at":"2026-08-08T13:44:02.865032Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.869623Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.869623Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:bdc7e51bf05010ed387008c05e3307a61088e0f86c96f67394f5d0786c1adf58","observation_id":"55d57eb5-8542-4dbc-a811-d73e8f9e686c","resolution":{"observed_at":"2026-08-08T13:44:02.869623Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.874236Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.874236Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:a79472552be69b245002a030ba7436a40c585efc524498fefdb9d4f8a76adec7","observation_id":"b5efa369-25fe-475f-b0d8-a7bb13d49064","resolution":{"observed_at":"2026-08-08T13:44:02.874236Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.597505Z","title":null,"venue":null,"work_id":"ea7d4698-1831-4695-908f-86b10a122e63","year":2021},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.879671Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:4e13db7da5e5191d740fb060b410a99163344cead940ba2aed979ed823c2762e","observation_id":"17d60e01-393c-47ca-8d24-ddd627a577da","resolution":{"observed_at":"2026-08-08T13:44:03.602445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.581520Z","title":null,"venue":null,"work_id":"ba6df3d1-47aa-4a26-af85-5ba7a65bc2b6","year":2021},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.884167Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:0ff441e9979353800a2cb98d66a6f54b6ed0938404ca7bc58e3ef8bdbcfcaf41","observation_id":"a8eceed1-bde2-4e6c-a5c0-a1c5acb5a94d","resolution":{"observed_at":"2026-08-08T13:44:03.586977Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.566630Z","title":null,"venue":null,"work_id":"33d54b00-68e2-4ed7-abd2-f56eb29fd514","year":null},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.888678Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:2f1c9f4f5303388c85c86264ff3b87177db7b600af88b7900031a55b5ab276ef","observation_id":"742a4f20-388f-4b5b-ae1f-083db6da44d6","resolution":{"observed_at":"2026-08-08T13:44:03.571228Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.900660Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.900660Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:a2dcacf5407d222e26cf61d483aa0246fdf1ab1e11ed088230ac21d1cb0c476a","observation_id":"74a78f99-2a28-4239-b16e-5de1d36b3897","resolution":{"observed_at":"2026-08-08T13:44:02.900660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-08T13:44:02.910414Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.910414Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:afcae4e5e7e3552e023d1ecb369ff43d612a12fa9bc74fcb9f84ed9f3f6392ba","observation_id":"c8dac09a-16ca-47a5-a689-024f7ae9486a","resolution":{"observed_at":"2026-08-08T13:44:02.910414Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2110.00413","last_updated":"2021-09-24T17:11:42Z","snapshot_observed_at":"2026-08-04T01:59:46.676981Z","submitted_at":"2021-09-24T17:11:42Z","title":"Detecting Harmful Memes and Their Targets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2110.00413","snapshot_observed_at":"2026-08-08T13:44:02.915248Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.915248Z"},"links":{"cited_paper":"/paper/2110.00413","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:13c68ffb8e158d9916717ca160fffe3506a9ea581ce2d7b658318ddbdd51c9d2","observation_id":"f18dcbb1-d50d-4e60-aa49-9a8b1ef45865","resolution":{"observed_at":"2026-08-08T13:44:02.915248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.08110","last_updated":"2024-10-30T12:34:16Z","snapshot_observed_at":"2026-08-02T08:44:15.425923Z","submitted_at":"2023-11-14T12:14:54Z","title":"Improving Hateful Meme Detection through Retrieval-Guided Contrastive Learning","version":3},"cited_work":{"arxiv_id":"2311.08110","doi":null,"metadata_source":"pith","pith_arxiv_id":"2311.08110","snapshot_observed_at":"2026-08-08T13:44:03.304946Z","title":"Improving Hateful Meme Detection through Retrieval-Guided Contrastive Learning","venue":"cs.CL","work_id":"7d0e5efb-aeed-4460-b69c-c8652066eca6","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.894742Z"},"links":{"cited_paper":"/paper/2311.08110","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:f565024c6c05966603e2ebc73195f524e5d8964c527b7e33411fadc8f6ec6841","observation_id":"46ad1bb7-01c5-4c9a-84af-47640819ce23","resolution":{"observed_at":"2026-08-08T13:44:03.312083Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.531916Z","title":null,"venue":null,"work_id":"dcfe7117-b595-4f18-8416-41a50520a1ec","year":2022},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.924735Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:3246ccf5d52bdc2d0dab54322c7f3ba98d3a29ccee7803e673008cf65a6d1480","observation_id":"1c06773e-6a99-44ac-b37f-d0abbc8da2fd","resolution":{"observed_at":"2026-08-08T13:44:03.536737Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1409.1556","last_updated":"2015-04-10T16:25:04Z","snapshot_observed_at":"2026-07-06T03:53:32.549552Z","submitted_at":"2014-09-04T19:48:04Z","title":"Very Deep Convolutional Networks for Large-Scale Image Recognition","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1409.1556","snapshot_observed_at":"2026-08-08T13:44:02.929291Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.929291Z"},"links":{"cited_paper":"/paper/1409.1556","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:d7b0a20b5c5d038f8c3520b65d76d4a505ea8d7d23af232df29ea15c8aa0a7c0","observation_id":"857c77f8-4e9a-45f5-80d8-f9ac9a587f70","resolution":{"observed_at":"2026-08-08T13:44:02.929291Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.516189Z","title":null,"venue":null,"work_id":"092b5615-de5b-44ac-a03d-dcf50ec8a8fc","year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.934114Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:ba61fb4d1436147d45aaf17346f1871d37b8dbb35f025a2377542d41de77a0a9","observation_id":"a494098f-7e9d-435b-923a-f9fad10559ee","resolution":{"observed_at":"2026-08-08T13:44:03.520952Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.500271Z","title":null,"venue":null,"work_id":"c9df18e9-b608-4e60-a8d2-9b04bb9b8b43","year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.938870Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:6c58771aec7c42ae6031113ab8d02dae8a37f1c520bdf680aec90a385c9687ae","observation_id":"b9eb9150-54b9-40f2-ab9d-bcbf7315aa23","resolution":{"observed_at":"2026-08-08T13:44:03.505240Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.919925Z","title":null,"venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.919925Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:b0c47467ff094c4727bb3e8e2943c10de5a0f661e2929dd9b8c1d15568d60917","observation_id":"a3386ba7-c049-4eb0-a56a-b4c7e400b91f","resolution":{"observed_at":"2026-08-08T13:44:02.919925Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.948156Z","title":null,"venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.948156Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:188453f0a8821431bf588536a5da2ab9a98c14a360735be780d5b8caf1e552c4","observation_id":"c53ecdb6-8c9a-40e1-b8c3-98d1c44c8f54","resolution":{"observed_at":"2026-08-08T13:44:02.948156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.952642Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.952642Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:e3f5e1a376119d84776aca03bd47e4cdc27c79913be464f6cfb433326d4c2297","observation_id":"3b7d05b8-8778-44af-904c-ab68a6acf8e5","resolution":{"observed_at":"2026-08-08T13:44:02.952642Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:03.465651Z","title":"the the the the the the the the the the","venue":null,"work_id":"bf4ddc8a-44f4-43b9-a9ba-49561d15708b","year":2018},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.957029Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:44b2f2361b3e4ee18990485598f2bd0f9307218ffc53cfee5898c852834e82af","observation_id":"985f46f7-8917-4986-9803-f532e280d000","resolution":{"observed_at":"2026-08-08T13:44:03.470410Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.943466Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.943466Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:fd2bdef7f1876c4844eb4c98f83d097de39582c94286b91d529c01a896797ae7","observation_id":"28d7c9e1-184c-4929-828a-8ca377c0b5fb","resolution":{"observed_at":"2026-08-08T13:44:02.943466Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1809.04444","last_updated":"2018-09-12T13:51:02Z","snapshot_observed_at":"2026-07-06T07:00:48.332422Z","submitted_at":"2018-09-12T13:51:02Z","title":"Hate Speech Dataset from a White Supremacy Forum","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1809.04444","snapshot_observed_at":"2026-08-08T13:44:02.796547Z","title":"arXiv preprint arXiv:1809.04444 (2018)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.796547Z"},"links":{"cited_paper":"/paper/1809.04444","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:f5ff5f7e524badfc3b29506a1f44e2a732107ece87f7d26d9493be209ecc02f6","observation_id":"6498cd9c-a8e4-4923-b78f-b6e6978744e6","resolution":{"observed_at":"2026-08-08T13:44:02.796547Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2006.08328","last_updated":"2021-07-06T07:25:14Z","snapshot_observed_at":"2026-08-07T19:06:22.193359Z","submitted_at":"2020-06-11T08:59:57Z","title":"ETHOS: an Online Hate Speech Detection Dataset","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2006.08328","snapshot_observed_at":"2026-08-08T13:44:02.905516Z","title":"arXiv preprint arXiv:2006.08328 (2020)","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.905516Z"},"links":{"cited_paper":"/paper/2006.08328","citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:12c1ae29b96636cc7cea1df387d9e01d57bc5e83c5e4085541be1f31be51392d","observation_id":"c431b876-7094-409d-b354-247574bd9af5","resolution":{"observed_at":"2026-08-08T13:44:02.905516Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.557611Z","title":"Advances in neural information processing systems 35 (2022), 23716–23736","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.557611Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:54fedc0780762b86d18c8c61de3c70f0a276c295fd1505e63fb6b372a2654ab6","observation_id":"34f60b51-ab11-4302-a4cf-2979cd6369c0","resolution":{"observed_at":"2026-08-08T13:44:02.557611Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-08T13:44:02.815961Z","title":"InICASSP 2023-2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP)","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-08T13:44:02.815961Z"},"links":{"citing_paper":"/paper/2502.07138"},"observation_digest":"sha256:d3e8e5d4293d52d4e0c1ea6eeb49a32d15d8a2efe450c2c883e5e99450862fb6","observation_id":"f88d2004-96f0-4d37-b8fa-67ac600ccedd","resolution":{"observed_at":"2026-08-08T13:44:02.815961Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2502.07138","last_updated":"2025-02-11T00:07:40Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T13:39:16.436016Z","submitted_at":"2025-02-11T00:07:40Z","title":"Towards a Robust Framework for Multimodal Hate Detection: A Study on Video vs. Image-based Content"},"reference_resolution":{"displayed":49,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":46,"verified_exact":1,"verified_fuzzy":1},"total_outbound_references":49},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 49 of 49 outbound references and 0 inbound Pith citation observations for arXiv:2502.07138."}