{"as_of":"2026-08-07T20:09:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:7961f86d0ce0edcaccbc88e3b76b5d8c9fe4ba9f66c0956806325fb63004a04d","coverage":[{"denominator":73,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":73,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T00:41:52.356831Z","state":"measured"},{"denominator":73,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":73,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2506.12992/citation-record","integrity":"/paper/2506.12992/integrity","json":"/paper/2506.12992/citation-record.json","paper":"/paper/2506.12992"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T00:41:51.198200Z","title":"Gpt-4 technical report.arXiv preprint arXiv:2303.08774,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.198200Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:c48fe2eacd4b28505578c37bd068f6134f976dcde0888cd37e5091380c783382","observation_id":"c65ee355-440d-4d1c-9031-a7f7d50b199b","resolution":{"observed_at":"2026-08-07T00:41:51.198200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:51.202802Z","title":"Flamingo: a visual language model for few-shot learning.Advances in neural information processing systems, 35:23716–23736,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.202802Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:48d83d32d70999dbcbe2892ba880b8f09fc399341d8e1ea592e32f45daf339ee","observation_id":"d602e8ab-670f-4151-a87b-662bcd969a2d","resolution":{"observed_at":"2026-08-07T00:41:51.202802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:03.429837Z","title":"Real-time video anomaly detection for smart surveillance.IET Image Processing, 17(5):1375–1388,","venue":null,"work_id":"a9f3ec36-cdbd-4c4b-bbab-2278b9b5a1a1","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.207222Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:f35cc4a7ed799e9840e86199618fe370c2ea16cd3e452d49d62c3081e9c76dc6","observation_id":"86f93241-a0b7-49b7-894a-fe9568c1cff0","resolution":{"observed_at":"2026-08-07T00:42:03.537626Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:03.058128Z","title":"Claude 3.5 sonnet, 2024","venue":null,"work_id":"a1916a66-0f63-49b5-b392-88e6b5e27b9a","year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.211378Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:bad8ad82d70061bbc274e59b6cc2f551c79654c6c2fbcdd1181e6c248d531b86","observation_id":"3e2cfba2-60c3-4a1e-82bb-1724a5c94aa8","resolution":{"observed_at":"2026-08-07T00:42:03.239961Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:02.785553Z","title":"Activity and anomaly detec- tion in smart home: A survey.Next generation sensors and systems, pages 191–220, 2015","venue":null,"work_id":"e44accca-fcc7-475c-b7a4-3221fbf65efa","year":2015},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.215330Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:04901ccf11012a53d67385b27a3b9d69691f8e5f57ae41bd95c7812e9d4f0386","observation_id":"cfb3e1aa-db72-4f18-ab64-1199bdb51bf7","resolution":{"observed_at":"2026-08-07T00:42:02.903399Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00675","last_updated":"2024-05-27T08:53:15Z","snapshot_observed_at":"2026-08-03T01:24:09.971149Z","submitted_at":"2024-03-31T12:48:07Z","title":"LLM meets Vision-Language Models for Zero-Shot One-Class Classification","version":3},"cited_work":{"arxiv_id":"2404.00675","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.00675","snapshot_observed_at":"2026-08-07T00:41:53.029444Z","title":"LLM meets Vision-Language Models for Zero-Shot One-Class Classification","venue":"cs.CV","work_id":"47c91749-2fdf-48c9-8a56-aeb76c62f92a","year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.219612Z"},"links":{"cited_paper":"/paper/2404.00675","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:373c40c195d5ca4f1e95e2705c801d82b8263fc7f94ac92e69c2ea75d3ac9792","observation_id":"771dbe9f-de6c-4170-94d2-b41cd4d735ec","resolution":{"observed_at":"2026-08-07T00:41:53.064551Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10326","last_updated":"2025-03-24T20:26:56Z","snapshot_observed_at":"2026-07-06T18:31:13.039726Z","submitted_at":"2024-06-14T17:59:01Z","title":"VANE-Bench: Video Anomaly Evaluation Benchmark for Conversational LMMs","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10326","snapshot_observed_at":"2026-08-07T00:41:51.223748Z","title":"Vane-bench: Video anomaly evaluation benchmark for conversational lmms","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.223748Z"},"links":{"cited_paper":"/paper/2406.10326","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:0514a46e4e6b74f99bff7b655b70d621b3f3e9b9057035019200e3d95ce1d261","observation_id":"7eced5c7-2dfc-4b47-bbc4-93255ade7187","resolution":{"observed_at":"2026-08-07T00:41:51.223748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:02.365766Z","title":"Meva: A large-scale multiview, multimodal video dataset for activity detection","venue":null,"work_id":"f2722644-cd4e-427d-a8c4-a5408fddb5ad","year":2021},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.229402Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:bb9717de156db82c408b83fc8b15e0569fb232f90f5d6b4c28a6ab4ca9c14cac","observation_id":"b60ce25e-177a-4860-957c-b1ab4762e49b","resolution":{"observed_at":"2026-08-07T00:42:02.553464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.03378","last_updated":"2023-03-06T18:58:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-03-06T18:58:06Z","title":"PaLM-E: An Embodied Multimodal Language Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.03378","snapshot_observed_at":"2026-08-07T00:41:51.233175Z","title":"Palm- e: An embodied multimodal language model.arXiv preprint arXiv:2303.03378, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.233175Z"},"links":{"cited_paper":"/paper/2303.03378","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:b9ac44af42a422e07fc6e29efde13f8b66f29ce86d5a05353980b3fe5e774739","observation_id":"a85bdad4-9691-4f34-8498-df1edcd1699c","resolution":{"observed_at":"2026-08-07T00:41:51.233175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.21075","last_updated":"2025-05-30T13:08:27Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-05-31T17:59:47Z","title":"Video-MME: The First-Ever Comprehensive Evaluation Benchmark of Multi-modal LLMs in Video Analysis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.21075","snapshot_observed_at":"2026-08-07T00:41:51.238033Z","title":"Video-mme: The first-ever compre- hensive evaluation benchmark of multi-modal llms in video analysis.arXiv preprint arXiv:2405.21075, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.238033Z"},"links":{"cited_paper":"/paper/2405.21075","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:0917d9ead018791304f4c5de7e3ae41a61b997bc9e4d32f67d08d34f0a8b1049","observation_id":"ddded8a2-e735-4c72-866b-f1b0b8589133","resolution":{"observed_at":"2026-08-07T00:41:51.238033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:51.242869Z","title":"Memorizing normality to detect anomaly: Memory-augmented deep autoencoder for unsupervised anomaly detection","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.242869Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:b689fee566697be90da37b1dcb9d7eec3c66a33c0c5824d2d5ce88f485a223e8","observation_id":"6005372d-82df-4fb2-a56e-9a674303dff7","resolution":{"observed_at":"2026-08-07T00:41:51.242869Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:02.076088Z","title":"Learning temporal reg- ularity in video sequences","venue":null,"work_id":"32081f1d-63b3-4370-b9ea-3c5014853d15","year":2016},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.247050Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:60dfdc7bd44111ce1932494fa33facf324fed5ea00b17bd2519f3f355de0c34b","observation_id":"04fe632d-1c7c-4f75-8621-cd234d94a7a3","resolution":{"observed_at":"2026-08-07T00:42:02.236544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.21276","last_updated":"2024-10-25T17:43:01Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-10-25T17:43:01Z","title":"GPT-4o System Card","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.21276","snapshot_observed_at":"2026-08-07T00:41:51.251699Z","title":"Gpt-4o system card","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.251699Z"},"links":{"cited_paper":"/paper/2410.21276","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:b928b3ed133f18d7efc0e7a2a28bbfeeb7d6d73d5082d177af00990e260e728a","observation_id":"2d63a38c-1f9f-46d1-81b3-486b31254e39","resolution":{"observed_at":"2026-08-07T00:41:51.251699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.06674","last_updated":"2023-12-07T19:40:50Z","snapshot_observed_at":"2026-07-06T17:00:00.321552Z","submitted_at":"2023-12-07T19:40:50Z","title":"Llama Guard: LLM-based Input-Output Safeguard for Human-AI Conversations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.06674","snapshot_observed_at":"2026-08-07T00:41:51.256225Z","title":"Llama guard: Llm- based input-output safeguard for human-ai conversations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.256225Z"},"links":{"cited_paper":"/paper/2312.06674","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:cafe4d00a528548c6b359c372693bda0e31f94d1fb67a8e14b7a518ec604567d","observation_id":"45db551d-7a63-4765-a360-9c5e1771aa46","resolution":{"observed_at":"2026-08-07T00:41:51.256225Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:01.800969Z","title":"Object-centric auto-encoders and dummy anomalies for abnormal event detection in video","venue":null,"work_id":"7cdace21-d6ee-4ff4-80c9-d38e904b9155","year":2019},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.261744Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:679042b3e92e3306446376cc7a65f63c5656d0065eec8655416eb9a33027984f","observation_id":"6c0b10bb-0de1-4575-9f55-e63369a34c2d","resolution":{"observed_at":"2026-08-07T00:42:01.939423Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:01.452808Z","title":"Dog behavior recognition based on multimodal data from a camera and wearable de- vice.Applied sciences, 12(6):3199, 2022","venue":null,"work_id":"ce31e708-1c2f-4b14-9a46-39351a8cf7e4","year":2022},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.265388Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:1909ee2603b010597050b7d20d3db67e3a66ba9ecdd9c0bc6a7355c04376066f","observation_id":"543f2553-48dd-4eda-9e25-1d835b3fc128","resolution":{"observed_at":"2026-08-07T00:42:01.663783Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:51.269716Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.269716Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:ae5de976859109f072d908b2b739491d18b9106b3dce5cc216279b14cc8de17d","observation_id":"ea293c83-221f-4098-9eba-59fd8f746e4d","resolution":{"observed_at":"2026-08-07T00:41:51.269716Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-07T00:41:51.274375Z","title":"Videochat: Chat-centric video understanding.arXiv preprint arXiv:2305.06355, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.274375Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:f757f35c64fa96e481f334199943eb475b3610ed57137e693aa071453573aff9","observation_id":"382a5726-de98-4256-b7eb-0cd9cc1efef9","resolution":{"observed_at":"2026-08-07T00:41:51.274375Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:51.278561Z","title":"Mvbench: A comprehensive multi-modal video understand- ing benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.278561Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:65e42d99dd5d528d893db3de19dea9e0bec1e3927c24234b98fb7ed63e8c0ade","observation_id":"511bb7cd-5077-4a51-91b6-0918c12a7f58","resolution":{"observed_at":"2026-08-07T00:41:51.278561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:01.308304Z","title":"Self-training multi- sequence learning with transformer for weakly supervised video anomaly detection","venue":null,"work_id":"041f7191-1f7b-47d0-8aa5-1af139aee535","year":2022},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.282573Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:ab1a8f6f82812a5a41cd6154183322a4f239bff877b6bf8f33e390645a6f9099","observation_id":"88ab1419-1b97-4bff-a752-b6ab16926e90","resolution":{"observed_at":"2026-08-07T00:42:01.341891Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:51.286220Z","title":"Anomaly detection and localization in crowded scenes.IEEE transactions on pattern analysis and machine intelligence, 36(1):18–32, 2013","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.286220Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:ba213d3321f74ca045a608ae3e461d9e9b0c794d3705fa5fdae0811c3be96912","observation_id":"0d21c970-7e54-4191-94ca-0760e2281ac5","resolution":{"observed_at":"2026-08-07T00:41:51.286220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.11303","last_updated":"2024-06-17T08:09:00Z","snapshot_observed_at":"2026-08-04T15:53:11.168523Z","submitted_at":"2024-06-17T08:09:00Z","title":"VideoVista: A Versatile Benchmark for Video Understanding and Reasoning","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.11303","snapshot_observed_at":"2026-08-07T00:41:51.290582Z","title":"Videovista: A versatile bench- mark for video understanding and reasoning.arXiv preprint arXiv:2406.11303, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.290582Z"},"links":{"cited_paper":"/paper/2406.11303","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:fd1bce31165cffae6bfe634ff7547a3efa91a9c10045c173120eb78ca4ddf664","observation_id":"fd3247c8-5278-4a34-86de-a9e8723a234c","resolution":{"observed_at":"2026-08-07T00:41:51.290582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:01.056097Z","title":"Vila: On pre-training for vi- sual language models","venue":null,"work_id":"3e63e687-d6dc-40b1-b229-b89df1f95611","year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.295830Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:567e2f4502df3ed9b4f0e9b67e20e3cb1e5fdbcc1c027da905a0624e948a19c7","observation_id":"b8e42c42-c84c-4dcf-acb5-b858f83149f2","resolution":{"observed_at":"2026-08-07T00:42:01.186594Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:00.921887Z","title":"Privacy-preserving video fall detection using visual shielding information.The Visual Computer, 37(2):359–370, 2021","venue":null,"work_id":"6c3770ca-20cc-4bb2-a18e-a3843ec768d8","year":2021},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.299494Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:98e70cce524509a6cd316e0db84eb9b5fc4596948f4868e09ffa48f08c9f9c6e","observation_id":"976d6078-4f26-4bd7-9a6b-ddf337aa4e9e","resolution":{"observed_at":"2026-08-07T00:42:00.976460Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:51.303272Z","title":"Fu- ture frame prediction for anomaly detection–a new baseline","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.303272Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:f2438ac802b379f9636784358adff5941fb6fbdb0043e7ba6260df5f067c10da","observation_id":"a74374d7-d9a7-4620-b3d9-b30dfa6a31b9","resolution":{"observed_at":"2026-08-07T00:41:51.303272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00476","last_updated":"2024-06-03T04:13:39Z","snapshot_observed_at":"2026-08-04T21:17:37.211833Z","submitted_at":"2024-03-01T12:02:19Z","title":"TempCompass: Do Video LLMs Really Understand Videos?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00476","snapshot_observed_at":"2026-08-07T00:41:51.306675Z","title":"Tempcom- pass: Do video llms really understand videos?arXiv preprint arXiv:2403.00476, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.306675Z"},"links":{"cited_paper":"/paper/2403.00476","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:c7c1eac4ca5e50d471a131e29e462e6ce1a983d46fca7b7e07e331101c9cddee","observation_id":"027165cd-8756-4ea9-ad86-80f1d575d09e","resolution":{"observed_at":"2026-08-07T00:41:51.306675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:51.311239Z","title":"Abnormal event detec- tion at 150 fps in matlab","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.311239Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:759e0ac8dc56d93cd45ee8cf86a29f8de7c5178078b2f29d80de2934afede315","observation_id":"5fe4d144-4107-4515-9cfb-a3768274e64d","resolution":{"observed_at":"2026-08-07T00:41:51.311239Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.05702","last_updated":"2024-01-11T07:09:44Z","snapshot_observed_at":"2026-07-06T17:14:07.183954Z","submitted_at":"2024-01-11T07:09:44Z","title":"Video Anomaly Detection and Explanation via Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.05702","snapshot_observed_at":"2026-08-07T00:41:51.315197Z","title":"Video anomaly detection and explanation via large language models.arXiv preprint arXiv:2401.05702, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.315197Z"},"links":{"cited_paper":"/paper/2401.05702","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:104f9e824004104e1ad4aec70b2314db1b33580a0d634de19b8b2c1d69cd0491","observation_id":"10896c31-8b20-4635-a97b-4456507cc1fb","resolution":{"observed_at":"2026-08-07T00:41:51.315197Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:00.765982Z","title":"Learning normal dynamics in videos with meta prototype network","venue":null,"work_id":"32eb7654-f341-4f48-8070-1990c9419d55","year":2021},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.319818Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:6b0ccc88945c78e2e4ae376f676c752f1ecefeaf981c724b6d94c96cbb3557a8","observation_id":"5f18185c-bafb-462d-a7f6-a7e5424b844f","resolution":{"observed_at":"2026-08-07T00:42:00.807819Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-07T00:41:51.323429Z","title":"Video-chatgpt: Towards detailed video understanding via large vision and language models.arXiv preprint arXiv:2306.05424, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.323429Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:d7543e61d6e86f4eb3120255ab6062e98b6c4780f2df4b0afe77b35c007b306e","observation_id":"bfe99dac-ccfb-47fe-97b2-9c424d8ac1e9","resolution":{"observed_at":"2026-08-07T00:41:51.323429Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:51.327831Z","title":"Graph embedded pose clustering for anomaly detection","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.327831Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:9ec36fbca1318af870a0b1db2a9e89e020fd000c2885f46b28ea515ab1afbd22","observation_id":"c9573118-c9f0-4b3b-9d90-a073c417cab2","resolution":{"observed_at":"2026-08-07T00:41:51.327831Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:51.332269Z","title":"Using an llm to help with code understanding","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.332269Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:728eae10d32ff424c0466739d9f840f470c1dded6a3ceb91c8a0a73f48737f78","observation_id":"b9eb9251-4850-448e-8e1b-61e65211bc9d","resolution":{"observed_at":"2026-08-07T00:41:51.332269Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:00.647177Z","title":"A comprehensive review on deep learning-based methods for video anomaly detection.Image and Vision Computing, 106:104078, 2021","venue":null,"work_id":"2695670b-ae91-400a-a206-353518bb9574","year":2021},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.337254Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:df2e60e69dd98fd508dbce23796a1e728c7d5180dd3e7b6245bc2bd309d68e81","observation_id":"86cd455a-6607-494e-9da2-5e7fd03a58c5","resolution":{"observed_at":"2026-08-07T00:42:00.694436Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:00.545121Z","title":"Callm: Cas- cading autoencoder and large language model for video anomaly detection","venue":null,"work_id":"c36a3cd5-492d-4523-8622-45a044b1b148","year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.341914Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:4ba12d69ad7373b75a6c627ffeda514a38f1eee67aa17faa146e140ea15416f5","observation_id":"f52ac5a3-7ae7-4c41-8f97-634372675c0f","resolution":{"observed_at":"2026-08-07T00:42:00.590382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:00.391575Z","title":"Evaluating the impact of hallucinations on user trust and satisfaction in llm-based systems, 2024","venue":null,"work_id":"ac252370-277d-4d3c-ba17-bee89af736ab","year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.346341Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:445375592afea4232dc379e8f61f8622a0d9282762fb128e181a39965caa7744","observation_id":"13a3ffa2-3b6c-4f36-b8f3-acedc7a8a4d0","resolution":{"observed_at":"2026-08-07T00:42:00.453137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:00.258123Z","title":"Gpt-4o-mini: Advancing cost-efficient intelligence,","venue":null,"work_id":"ad0abc5c-1edc-4be2-9caa-6febe66d5906","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.351094Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:b37047869807d52e632922b60b421e4ad41d230fba74c5636e36ce6f0e0cd6d3","observation_id":"50aabe3c-6f67-4790-b5d5-c48208fdb0de","resolution":{"observed_at":"2026-08-07T00:42:00.325683Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:00.028157Z","title":"Smart home anti-theft system: a novel approach for near real-time mon- itoring and smart home security for wellness protocol.Ap- plied System Innovation, 1(4):42, 2018","venue":null,"work_id":"251d3972-e0ec-40e0-bbb6-ba407a79eff2","year":2018},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.360243Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:3fd2763cdfe096f1ca0d0a9ffeac1a8a155d51cd5f48f4285d618f738fc788de","observation_id":"ac5fb0c6-1655-49cb-9a42-bbc9b7f9b23a","resolution":{"observed_at":"2026-08-07T00:42:00.084973Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:59.869741Z","title":"Deep video anomaly detection: Opportunities and challenges","venue":null,"work_id":"908eeee3-3d53-4a95-b3ba-fe7173aa27d2","year":2021},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.364192Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:fae6b631904a68051662ea5126d46d0579aecda658e46753ad180f426736dc48","observation_id":"65a11b67-d248-4ce7-85c5-badb3c849c01","resolution":{"observed_at":"2026-08-07T00:41:59.954301Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:59.759679Z","title":"Real-world anomaly detection in surveillance videos","venue":null,"work_id":"b49ffa67-58f5-4cff-bee4-9bd49bda6d3e","year":2018},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.368247Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:bed5d89f126048d5b46cc7f779362fddb15aea4d7dec8b7bb4c9ac0900621844","observation_id":"43897baf-53d4-423e-ac90-cb8343d0548c","resolution":{"observed_at":"2026-08-07T00:41:59.821553Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:59.613316Z","title":"Abnormal event de- tection for video surveillance using deep one-class learning","venue":null,"work_id":"915cbc9b-0f57-4137-86b0-ed337fea924d","year":2019},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.372364Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:1a868c41f538c054514ac68cfa4c5d291ed72ff817cf17d74461b3df2258cea3","observation_id":"f459c574-f304-45f5-81df-4a778ec43145","resolution":{"observed_at":"2026-08-07T00:41:59.709464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.11805","last_updated":"2025-05-09T21:04:06Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-12-19T02:39:27Z","title":"Gemini: A Family of Highly Capable Multimodal Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.11805","snapshot_observed_at":"2026-08-07T00:41:51.375903Z","title":"Gemini: a family of highly capable multimodal models.arXiv preprint arXiv:2312.11805, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.375903Z"},"links":{"cited_paper":"/paper/2312.11805","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:0aca9b20b6ac96c8f4c5987e85900e8808b6add1260f181626e08132ade9d8f0","observation_id":"30d3ea0c-c078-4b19-ab81-abd53040d7a9","resolution":{"observed_at":"2026-08-07T00:41:51.375903Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05530","last_updated":"2024-12-16T17:39:39Z","snapshot_observed_at":"2026-07-06T17:41:42.995949Z","submitted_at":"2024-03-08T18:54:20Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of context","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.05530","snapshot_observed_at":"2026-08-07T00:41:51.381498Z","title":"Gemini 1.5: Unlocking multimodal understanding across millions of tokens of con- text.arXiv preprint arXiv:2403.05530, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.381498Z"},"links":{"cited_paper":"/paper/2403.05530","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:2589a25df716d0a8d7b7a66790ffe8b513c7c9c15ce1babc3e64df9b3925bc89","observation_id":"1f5179f0-797f-43ac-b1e1-efa6b412739f","resolution":{"observed_at":"2026-08-07T00:41:51.381498Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:59.473560Z","title":"Weakly-supervised video anomaly detection with robust temporal feature magni- tude learning","venue":null,"work_id":"a3c61cbb-f3f5-4b70-8c62-b8252a7d7522","year":2021},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.391982Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:fc293ed6f5a2b3bcc15c7119c3afc8cb2b4b0a31685978a9f7de0aedf02c7571","observation_id":"06705239-cf38-4902-9006-f8f0d690618c","resolution":{"observed_at":"2026-08-07T00:41:59.540478Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:59.313433Z","title":"Chain-of-thought prompting elicits reasoning in large lan- guage models.Advances in neural information processing systems, 35:24824–24837, 2022","venue":null,"work_id":"b280b752-656b-421c-994b-2c3f411bb0a2","year":2022},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.403665Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:272643901a4dfc01f2aacd187902f0e4af36d9ad60e5c4c9e61b28af9d100cce","observation_id":"a802b030-74fc-472f-a355-25d5415bc030","resolution":{"observed_at":"2026-08-07T00:41:59.373107Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:59.161825Z","title":"Fall recovery sub- activity recognition with rgb-d cameras.IEEE transactions on industrial informatics, 12(6):2312–2320, 2016","venue":null,"work_id":"0a832901-fc29-4f60-a616-95f1a1c15f1c","year":2016},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.418804Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:5fa97f56da9258a460129eb4490e1dac4da44c11325e92e1bd1baf5082b2e212","observation_id":"b099c512-3b5f-488d-b69c-d34727d11f78","resolution":{"observed_at":"2026-08-07T00:41:59.244637Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:59.016282Z","title":"Learning causal temporal relation and feature discrimination for anomaly detection.IEEE Transac- tions on Image Processing, 30:3513–3527, 2021","venue":null,"work_id":"7e85fda9-6002-4e09-a875-b56bd617c63d","year":2021},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.434382Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:c40075461d9612e4cd5d3a374ea64d8d14518002596129819057dc006a314adc","observation_id":"5e221e2f-d988-4d38-bc89-e1c02fa2e366","resolution":{"observed_at":"2026-08-07T00:41:59.076083Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:58.901811Z","title":"Not only look, but also listen: Learning multimodal violence detection under weak supervision","venue":null,"work_id":"dd0719fa-66bc-4cd1-8aac-f5acfa042445","year":2020},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.449161Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:7ea7f5f045d793d1a4c6274f500ce21ac4df448fd73c42501823a2bd92105349","observation_id":"d0b35290-a391-4097-87a6-84ed925345ad","resolution":{"observed_at":"2026-08-07T00:41:58.944178Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:58.759240Z","title":"Ai chains: Transparent and controllable human-ai interaction by chaining large language model prompts","venue":null,"work_id":"dd5dc497-e06c-4d76-9318-9aa745c5ebfb","year":2022},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.459173Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:5a6081f38f89145042150603d35f5d3421dade375a6b108a1e3b4c9676f2334c","observation_id":"6527c149-7c4f-4125-8976-45115776b43e","resolution":{"observed_at":"2026-08-07T00:41:58.814417Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:51.470996Z","title":"Next-qa: Next phase of question-answering to explaining temporal actions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.470996Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:5d28f98b5346d76c888fd76791d163b7af7adfaa0356f84d031af91761b06f5a","observation_id":"be24a536-253e-40c7-96a5-b241fec4f9d9","resolution":{"observed_at":"2026-08-07T00:41:51.470996Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11083","last_updated":"2025-05-20T08:32:39Z","snapshot_observed_at":"2026-07-06T17:45:47.803735Z","submitted_at":"2024-03-17T04:30:57Z","title":"Customizing Visual-Language Foundation Models for Multi-modal Anomaly Detection and Reasoning","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.11083","snapshot_observed_at":"2026-08-07T00:41:51.482974Z","title":"Customizing visual-language founda- tion models for multi-modal anomaly detection and reason- ing.arXiv preprint arXiv:2403.11083, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.482974Z"},"links":{"cited_paper":"/paper/2403.11083","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:07d4923effd5f501035fed9958319af2a166afb7593fb57b04ebddebdbc3e0e8","observation_id":"48e17370-e0a5-410b-898a-a55c5ece6b1c","resolution":{"observed_at":"2026-08-07T00:41:51.482974Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:58.579412Z","title":"To- wards a data-driven adaptive anomaly detection system for human activity.Pattern Recognition Letters, 145:200–207,","venue":null,"work_id":"38e0e217-4783-4f14-8cac-093e03b72825","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.494475Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:fa12ab361c655c95b449f9c97a6b631aba5457228610c712aae7904a5b8e7f48","observation_id":"3494bb4d-1ede-4a53-9921-4c61f5e7a0a8","resolution":{"observed_at":"2026-08-07T00:41:58.679623Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:58.388088Z","title":"Anomaly detection in smart home operation from user behaviors and home conditions","venue":null,"work_id":"f0f07671-40ad-482f-891e-f4579e010a8b","year":2020},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.510784Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:1ae25ba62d646bfcd00f7985708c617cc8fb2bb2e94fa7eddabdfadb9242eb13","observation_id":"67d3f5a1-00a3-499b-a09b-6116fd346b11","resolution":{"observed_at":"2026-08-07T00:41:58.505248Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.10299","last_updated":"2024-07-20T07:56:47Z","snapshot_observed_at":"2026-07-06T18:46:09.997234Z","submitted_at":"2024-07-14T19:23:12Z","title":"Follow the Rules: Reasoning for Video Anomaly Detection with Large Language Models","version":2},"cited_work":{"arxiv_id":"2407.10299","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.10299","snapshot_observed_at":"2026-08-07T00:41:52.682990Z","title":"Follow the Rules: Reasoning for Video Anomaly Detection with Large Language Models","venue":"cs.CV","work_id":"69bee691-7729-46ce-b57c-c5a038bd46f9","year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.522641Z"},"links":{"cited_paper":"/paper/2407.10299","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:07549cc37d5ab4b9fe4fc0b4db4aa97e5904d89be6a22950034518dee099ad5c","observation_id":"997e33c2-519b-4291-8c22-d4aade57a666","resolution":{"observed_at":"2026-08-07T00:41:52.775995Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:58.253427Z","title":"Generative cooperative learning for unsupervised video anomaly detection","venue":null,"work_id":"7d060ee8-093a-48bf-82e6-30611160ac27","year":2022},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.533895Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:8e6b7c40413331ed825fb9b3bcd65b127f7736796f0142ab601c51e139891521","observation_id":"520900e3-a466-4aae-bf1a-963cc9b53a3e","resolution":{"observed_at":"2026-08-07T00:41:58.317228Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:58.016603Z","title":"Harnessing large language mod- els for training-free video anomaly detection","venue":null,"work_id":"41f1ab2f-1121-4df3-8dba-bbd11550c110","year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.545598Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:a31bdc617790cf864af6dcf5401d6e9e4730482864696bace49f9d4fc996e146","observation_id":"6b665dbb-87e7-4bbe-90eb-4b16c23bb031","resolution":{"observed_at":"2026-08-07T00:41:58.152370Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.12235","last_updated":"2024-06-29T08:15:27Z","snapshot_observed_at":"2026-07-06T18:32:40.207270Z","submitted_at":"2024-06-18T03:19:24Z","title":"Holmes-VAD: Towards Unbiased and Explainable Video Anomaly Detection via Multi-modal LLM","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.12235","snapshot_observed_at":"2026-08-07T00:41:51.558145Z","title":"Holmes-vad: Towards unbiased and explainable video anomaly detection via multi-modal llm","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.558145Z"},"links":{"cited_paper":"/paper/2406.12235","citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:b6aa9581fdc8d8d3f1ea2cb4ef232d2048c63a1e81980df6c6a72a6882f95a4c","observation_id":"e046dd30-bafc-4b9f-8f5d-4ae7b05afcf8","resolution":{"observed_at":"2026-08-07T00:41:51.558145Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:56.389170Z","title":"Isee smart home (ish): Smart video analysis for home security.Neu- rocomputing, 149:752–766, 2015","venue":null,"work_id":"6a4254e7-ba24-47ec-8035-82c4c1a7b7c3","year":2015},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.568507Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:0ab816fa700ec092ccceeee686c9a26cac1e62fdceb9eb4d031d27ff231abe84","observation_id":"675664cc-7331-494d-b709-735c915dc5c1","resolution":{"observed_at":"2026-08-07T00:41:57.561638Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:55.446420Z","title":"normality","venue":null,"work_id":"519de797-12aa-4bff-b453-48cf26be37b3","year":2021},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.579502Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:c4aece87bd05abb6378f9c9dbf7d7f15b02faef79e3f4ed987d7c06ed77b7d6b","observation_id":"b385fca3-5e29-49c3-905b-cce95c6f2915","resolution":{"observed_at":"2026-08-07T00:41:55.803721Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:55.155122Z","title":"video_description","venue":null,"work_id":"f425306e-72e8-4a16-a991-1a763d569744","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.591398Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:5f21ee4e301cf1a6d350aa83d5e113606919bd5956bfa2e51be4e0cf2289b472","observation_id":"5feb0905-6ea7-480e-b958-359ac2433f25","resolution":{"observed_at":"2026-08-07T00:41:55.236630Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:55.011811Z","title":"video_description","venue":null,"work_id":"94c776aa-4645-4883-b57f-c3a97097314a","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.604701Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:8ca27fbf07d4aeb43d18f5f82261c95792e96534154433ea04067bb115b6412b","observation_id":"c0200142-5190-4452-935e-aa0d56e51db1","resolution":{"observed_at":"2026-08-07T00:41:55.089346Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:54.856238Z","title":"video_description","venue":null,"work_id":"7d26f868-cd4b-4c08-8842-f1dff70bc8b0","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.620887Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:a735502855d829d7d1463e08db2dc53277e6dad17df80028c481979a886eeeea","observation_id":"4bf6ec25-903d-4da1-a74f-11910134217f","resolution":{"observed_at":"2026-08-07T00:41:54.931508Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:54.719302Z","title":"o Scheduled package deliveries or pickups without interference","venue":null,"work_id":"b82fa84c-890b-4b49-8557-634231647358","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.630160Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:297188bcda63d1b9253f5b19f0dd1483f57673d3129d604d72e3d0ac85b152f0","observation_id":"d31330f5-3422-47f3-a87e-70d15fab01ad","resolution":{"observed_at":"2026-08-07T00:41:54.781210Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:54.464218Z","title":"video_description","venue":null,"work_id":"011d5fc1-ec6c-4c14-b22c-217c9150de35","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.641773Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:23ed1c51e1622567cd573fa1b4d351521649cbc9f15e576188b83d699a23ed9f","observation_id":"cbbd08f5-742a-41be-bf59-185695e9399a","resolution":{"observed_at":"2026-08-07T00:41:54.600137Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:54.331633Z","title":null,"venue":null,"work_id":"d0c5c29b-b37c-4fdf-bc9c-88b61f4919d5","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.653561Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:949f28627b3157c0fac76e8c3d3844de634acfc64be2fe4e438fca2603773ae4","observation_id":"82e9a502-a666-42b2-a494-e90ace1ca72c","resolution":{"observed_at":"2026-08-07T00:41:54.398997Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:54.171083Z","title":"Pets seen outdoors without their owner, which could suggest escape or abandonment","venue":null,"work_id":"7bb796a8-5776-45d8-98f7-00f53628402d","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.721369Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:997fd798dd35aac0d0b48659ff48b54207f0c1362888a2d9a1a3973f4127e425","observation_id":"105587c7-3ae0-438c-98b4-6af6bfe1d275","resolution":{"observed_at":"2026-08-07T00:41:54.251490Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:53.847308Z","title":null,"venue":null,"work_id":"fef83826-4df4-4669-a088-48237670a61e","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.851797Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:c6bca2a8174504900d5d28df3973263c9c29d54a9aa00284c9f1a1a314e27428","observation_id":"c82f10a8-afaa-4306-8f39-540a469ccfaa","resolution":{"observed_at":"2026-08-07T00:41:53.928777Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:53.662191Z","title":null,"venue":null,"work_id":"db92212c-8379-48ca-b83d-6742fe924425","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.913792Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:dd8b64f99ee9ac95ebbc641a4e7ad4b14ce1227852b6f8db612ace2cf6b15136","observation_id":"56b33ec5-d884-4aa1-9f46-6d446f063920","resolution":{"observed_at":"2026-08-07T00:41:53.736954Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:53.500709Z","title":"Option\" : [","venue":null,"work_id":"3fd33e68-92e0-45c1-8003-e7660b46d549","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:52.006643Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:a80d0cc221aef1e679869f5d5f684af921bde04d826d9b1be515db22612e85dd","observation_id":"34596056-31a4-43c1-9e8e-b3baec4c40b7","resolution":{"observed_at":"2026-08-07T00:41:53.576576Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:53.993130Z","title":null,"venue":null,"work_id":"a3a58ff6-5ced-43a7-a02a-3fc03d59025d","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:52.068973Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:9e104cd9d1fc53b955cfb6a28934c32bdb05c2300ddddbade5686d9447936054","observation_id":"5f7660db-153c-497a-ab03-dd30a6e3b4c5","resolution":{"observed_at":"2026-08-07T00:41:54.056589Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:53.322620Z","title":null,"venue":null,"work_id":"01bf3b94-c974-4e56-a19b-d2ae94354b69","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:52.170129Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:1abf7638febb6134799f54590347e18bc66b790e40a7ea04820a116bfa59e5bf","observation_id":"5cbf1ff2-0784-4592-b3b1-253eceae9a95","resolution":{"observed_at":"2026-08-07T00:41:53.391200Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:53.155672Z","title":null,"venue":null,"work_id":"65c16b57-aa1c-43f3-bcca-14a9d4d18b45","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:52.260503Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:6b6512cca369f32d6c24375c4d56d4efe7718254bb7bb54e9440bad75a94adec","observation_id":"31db43ae-9725-478b-bb77-9343bd5e002d","resolution":{"observed_at":"2026-08-07T00:41:53.225859Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"7968.7210","doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:41:52.523481Z","title":"Option\" : [","venue":null,"work_id":"f222754e-4d61-49f5-bb57-4cc6d2042cc1","year":null},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:52.356831Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:3cf7fcc9f5aeb2e5e1aaaca71d7c2f59eacec716f35382fe24b61c34c92316e8","observation_id":"144df043-a652-499f-9407-6c7311a9d942","resolution":{"observed_at":"2026-08-07T00:41:52.598340Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T00:42:00.159868Z","title":null,"venue":null,"work_id":"92714acb-6d81-4c3b-b436-64b98004ad23","year":2025},"citing_paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-07T00:41:51.356257Z"},"links":{"citing_paper":"/paper/2506.12992"},"observation_digest":"sha256:020ad97aa34bdb1086b88c613c62725022099fc2a0aa994154676e2384e09107","observation_id":"b47679a7-f42f-4477-9a95-2e3bf28a769a","resolution":{"observed_at":"2026-08-07T00:42:00.202965Z","resolver_source":"raw_fallback","status":"parse_uncertain"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.12992","last_updated":"2025-06-15T23:20:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T00:35:03.776740Z","submitted_at":"2025-06-15T23:20:08Z","title":"SmartHome-Bench: A Comprehensive Benchmark for Video Anomaly Detection in Smart Homes Using Multi-Modal Large Language Models"},"reference_resolution":{"displayed":73,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":1,"unresolved":31,"verified_exact":2,"verified_fuzzy":38},"total_outbound_references":73},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 73 of 73 outbound references and 0 inbound Pith citation observations for arXiv:2506.12992."}