{"as_of":"2026-08-09T02:33:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b169c6ec8d4b42f3af04a64f84fa42ed0e4e6553aebd5808e318770c399e8377","coverage":[{"denominator":16,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":16,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T14:58:44.224235Z","state":"measured"},{"denominator":16,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":16,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.17204/citation-record","integrity":"/paper/2507.17204/integrity","json":"/paper/2507.17204/citation-record.json","paper":"/paper/2507.17204"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2310.06825","last_updated":"2023-10-10T17:54:58Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-10-10T17:54:58Z","title":"Mistral 7B","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06825","snapshot_observed_at":"2026-08-06T14:58:42.953734Z","title":"Preprint, arXiv:2310.06825","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:42.953734Z"},"links":{"cited_paper":"/paper/2310.06825","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:b9ad8d31655d2628835c07bd90970ca72c2a89c7f8022df17b95a0239339403f","observation_id":"988356ee-b128-436c-a8ef-0b97bc76ba13","resolution":{"observed_at":"2026-08-06T14:58:42.953734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15251","last_updated":"2026-05-03T08:23:53Z","snapshot_observed_at":"2026-08-04T21:47:49.059504Z","submitted_at":"2024-12-15T04:58:00Z","title":"IPS: In-Prompt Process Supervision for Short Video Content Moderation","version":3},"cited_work":{"arxiv_id":"2412.15251","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.15251","snapshot_observed_at":"2026-08-06T14:58:45.182956Z","title":"IPS: In-Prompt Process Supervision for Short Video Content Moderation","venue":"cs.CL","work_id":"dd129742-7e52-40a5-863a-03a303c87704","year":2024},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:43.065453Z"},"links":{"cited_paper":"/paper/2412.15251","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:0a4b7fdd3b1eb84a00428cc985ac1cb057791f510d9f32a880bce8bc53c205cb","observation_id":"e0a3a464-39ed-4780-8357-e9719c8c46eb","resolution":{"observed_at":"2026-08-06T14:58:45.318999Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03400","last_updated":"2024-03-07T12:04:54Z","snapshot_observed_at":"2026-07-06T16:28:09.133233Z","submitted_at":"2023-10-05T09:09:44Z","title":"Adapting Large Language Models for Content Moderation: Pitfalls in Data Engineering and Supervised Fine-tuning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03400","snapshot_observed_at":"2026-08-06T14:58:43.165069Z","title":"arXiv preprint arXiv:2310.03400","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:43.165069Z"},"links":{"cited_paper":"/paper/2310.03400","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:9b00a26d46e36d663a2e725c8601ba83d707185278a44147814d8aa16cd85712","observation_id":"71de29d7-7c0f-430c-8a2d-0990e53459ca","resolution":{"observed_at":"2026-08-06T14:58:43.165069Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.00142","last_updated":"2025-06-09T17:01:06Z","snapshot_observed_at":"2026-07-06T19:59:11.046948Z","submitted_at":"2024-11-28T18:55:41Z","title":"Enhancing Few-Shot Vision-Language Classification with Large Multimodal Model Features","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.00142","snapshot_observed_at":"2026-08-06T14:58:43.281185Z","title":"Preprint, arXiv:2412.00142","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:43.281185Z"},"links":{"cited_paper":"/paper/2412.00142","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:623ca750025d0f5972b44bd0eff1f424b049a5bc3a3435bcc43bf95e4eb9c6dc","observation_id":"f39de5d2-e178-4293-996e-9311c4bec4e9","resolution":{"observed_at":"2026-08-06T14:58:43.281185Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-06T14:58:43.372402Z","title":"Preprint, arXiv:2303.08774","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:43.372402Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:1be040cafc1db11a509909151698e9952d42dfca2deebd53a8c177c676dabbd8","observation_id":"23627c4d-aaaf-44fb-9531-01c815843b04","resolution":{"observed_at":"2026-08-06T14:58:43.372402Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:58:45.667751Z","title":"In Findings of the Association for Computational Linguistics: ACL 2024, pages 5735– 5748, Bangkok, Thailand","venue":null,"work_id":"9ed3e3f8-0fee-453f-92ae-ac2941fd4f2f","year":2024},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:43.401718Z"},"links":{"citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:9c3dea1d681c42a7eaa64fe469f729a421f0160a5789f44383bd60d34414453a","observation_id":"67ba5547-cdf6-48cf-a087-e56304231486","resolution":{"observed_at":"2026-08-06T14:58:45.799257Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.13337","last_updated":"2024-12-17T21:16:59Z","snapshot_observed_at":"2026-07-06T20:08:51.664923Z","submitted_at":"2024-12-17T21:16:59Z","title":"Unveiling the Secret Recipe: A Guide For Supervised Fine-Tuning Small LLMs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.13337","snapshot_observed_at":"2026-08-06T14:58:43.493356Z","title":"Preprint, arXiv:2412.13337","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:43.493356Z"},"links":{"cited_paper":"/paper/2412.13337","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:8ed8c62a4e70565df62e1572be733b2aba9cf12c2179a90218afb35b9baad9ad","observation_id":"afba8959-19d8-42b6-9574-00a5845b1a6e","resolution":{"observed_at":"2026-08-06T14:58:43.493356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18216","last_updated":"2025-01-20T06:04:13Z","snapshot_observed_at":"2026-08-08T10:38:05.079426Z","submitted_at":"2024-12-24T06:45:36Z","title":"ICM-Assistant: Instruction-tuning Multimodal Large Language Models for Rule-based Explainable Image Content Moderation","version":2},"cited_work":{"arxiv_id":"2412.18216","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.18216","snapshot_observed_at":"2026-08-06T14:58:44.939381Z","title":"ICM-Assistant: Instruction-tuning Multimodal Large Language Models for Rule-based Explainable Image Content Moderation","venue":"cs.CV","work_id":"f35e9300-4232-42f4-ba34-ae8f31c84205","year":2024},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:43.582211Z"},"links":{"cited_paper":"/paper/2412.18216","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:4379c6a87b6023f98a0c482c3c08450bac11eced2ed03df8fb9707966bb6deb9","observation_id":"a1087e48-b2b8-41dd-92b6-02c36f16c4de","resolution":{"observed_at":"2026-08-06T14:58:45.040986Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.14717","last_updated":"2025-03-08T13:10:57Z","snapshot_observed_at":"2026-07-06T19:54:09.469212Z","submitted_at":"2024-11-22T04:09:23Z","title":"FedMLLM: Federated Fine-tuning MLLM on Multimodal Heterogeneity Data","version":2},"cited_work":{"arxiv_id":"2411.14717","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.14717","snapshot_observed_at":"2026-08-06T14:58:44.663781Z","title":"FedMLLM: Federated Fine-tuning MLLM on Multimodal Heterogeneity Data","venue":"cs.LG","work_id":"f38dd412-98ed-4a0d-a210-82ff4520a09d","year":2024},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:43.734247Z"},"links":{"cited_paper":"/paper/2411.14717","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:086714aef646004561f3e9b5a17ad9edaa11e61132e54baa62f7a0ee29aa0a84","observation_id":"50e0c0df-1fa7-4c8f-b19f-bb0dcda53901","resolution":{"observed_at":"2026-08-06T14:58:44.850381Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.10674","last_updated":"2025-02-15T08:31:04Z","snapshot_observed_at":"2026-07-06T20:06:57.159160Z","submitted_at":"2024-12-14T04:22:09Z","title":"USM: Unbiased Survey Modeling for Limiting Negative User Experiences in Recommendation Systems","version":3},"cited_work":{"arxiv_id":"2412.10674","doi":null,"metadata_source":"pith","pith_arxiv_id":"2412.10674","snapshot_observed_at":"2026-08-06T14:58:44.423351Z","title":"USM: Unbiased Survey Modeling for Limiting Negative User Experiences in Recommendation Systems","venue":"cs.IR","work_id":"85813227-9b59-40d7-95c4-b65177170acb","year":2024},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:43.858080Z"},"links":{"cited_paper":"/paper/2412.10674","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:2efb4084a9e8893124d943433800fb5839e53e632b12c0b6f98c067f385b2949","observation_id":"962b06d7-7772-4a20-b809-db75de7a2320","resolution":{"observed_at":"2026-08-06T14:58:44.559603Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.18415","last_updated":"2024-11-03T18:23:45Z","snapshot_observed_at":"2026-08-08T18:13:25.984360Z","submitted_at":"2024-05-28T17:57:06Z","title":"Why are Visually-Grounded Language Models Bad at Image Classification?","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.18415","snapshot_observed_at":"2026-08-06T14:58:44.118082Z","title":"Xiongtao Zhou, Jie He, Yuhua Ke, Guangyao Zhu, Vic- tor Gutierrez Basulto, and Jeff Pan","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:44.118082Z"},"links":{"cited_paper":"/paper/2405.18415","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:51c094ec1d716212122b99f336cdb351ebe117513e483392974b3c0c8f153fa5","observation_id":"5b47dfc0-6f42-40af-9456-f23975f858c7","resolution":{"observed_at":"2026-08-06T14:58:44.118082Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T14:58:45.509582Z","title":"In Findings of the Association for Computational Linguistics: ACL 2024, pages 10057–10084, Bangkok, Thailand","venue":null,"work_id":"78925c3d-d59a-4c7a-aa3f-8bdd8031e6a3","year":2024},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:44.224235Z"},"links":{"citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:05e41db96e9cc9b27e23936c4b45422491431613a11e6c8ec4a3c53d812c857a","observation_id":"9a19600b-785c-4f81-89fa-571c33ae0777","resolution":{"observed_at":"2026-08-06T14:58:45.567416Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2111.08276","last_updated":"2022-06-01T16:45:09Z","snapshot_observed_at":"2026-08-09T00:48:25.798151Z","submitted_at":"2021-11-16T07:55:26Z","title":"Multi-Grained Vision Language Pre-Training: Aligning Texts with Visual Concepts","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.08276","snapshot_observed_at":"2026-08-06T14:58:44.002049Z","title":"Preprint, arXiv:2111.08276","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:44.002049Z"},"links":{"cited_paper":"/paper/2111.08276","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:51f1ac2273fec2ab0cafc6b56356e59864185c04eb099c0bf6cb4cfeaf4a0d69","observation_id":"e4f707dc-4835-4fa4-8c53-b371b38b35ad","resolution":{"observed_at":"2026-08-06T14:58:44.002049Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.12948","last_updated":"2026-01-04T03:57:36Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-22T15:19:35Z","title":"DeepSeek-R1: Incentivizing Reasoning Capability in LLMs via Reinforcement Learning","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.12948","snapshot_observed_at":"2026-08-06T14:58:42.783915Z","title":"In Proceedings of the International AAAI Conference on Web and Social Media , volume 17, pages 1014–1023","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:42.783915Z"},"links":{"cited_paper":"/paper/2501.12948","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:0b7bc6db207a79c2d31a1563c789cd35f597a1fc1a36817d071097655b417c34","observation_id":"37823ac5-a2e9-497d-9586-7e39cc2bea91","resolution":{"observed_at":"2026-08-06T14:58:42.783915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.21439","last_updated":"2024-09-25T06:14:03Z","snapshot_observed_at":"2026-07-06T18:54:54.118506Z","submitted_at":"2024-07-31T08:43:17Z","title":"MLLM Is a Strong Reranker: Advancing Multimodal Retrieval-augmented Generation via Knowledge-enhanced Reranking and Noise-injected Training","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.21439","snapshot_observed_at":"2026-08-06T14:58:42.431248Z","title":"arXiv preprint arXiv:2407.21439","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:42.431248Z"},"links":{"cited_paper":"/paper/2407.21439","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:91cd44880f00d0906814b3c5c4b0c01a218b8759c2137ed48246363f98e2aa45","observation_id":"455e2a99-45a1-4abe-8724-6e181a5c3fde","resolution":{"observed_at":"2026-08-06T14:58:42.431248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.15795","last_updated":"2025-01-27T05:41:10Z","snapshot_observed_at":"2026-07-06T20:26:31.558337Z","submitted_at":"2025-01-27T05:41:10Z","title":"Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.15795","snapshot_observed_at":"2026-08-06T14:58:42.623068Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation","version":1},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-06T14:58:42.623068Z"},"links":{"cited_paper":"/paper/2501.15795","citing_paper":"/paper/2507.17204"},"observation_digest":"sha256:97281e4510458765267e6f920a63bd86f4c04186f8d154ab5287ad07bc894aa4","observation_id":"57437c8c-ddc2-45a8-aa45-aa22c5afefaa","resolution":{"observed_at":"2026-08-06T14:58:42.623068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2507.17204","last_updated":"2025-07-23T04:52:58Z","latest_version":1,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-08T01:25:36.159172Z","submitted_at":"2025-07-23T04:52:58Z","title":"Filter-And-Refine: A MLLM Based Cascade System for Industrial-Scale Video Content Moderation"},"reference_resolution":{"displayed":16,"state_counts":{"malformed_identifier":0,"metadata_mismatch":4,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":2},"total_outbound_references":16},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 16 of 16 outbound references and 0 inbound Pith citation observations for arXiv:2507.17204."}