{"as_of":"2026-08-08T10:42:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:21f7862421177b92ed122df57933b657c75f5199ed71de9eedfc9d0b6e53da52","coverage":[{"denominator":68,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":68,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T12:50:06.708410Z","state":"measured"},{"denominator":70,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":70,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":2,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":2,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T23:13:08.790871Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-12T09:01:26.251127Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.03179","snapshot_observed_at":"2026-08-06T23:13:08.790871Z","title":"Vid-sme: Membership inference attacks against large video understanding models.arXiv preprint arXiv:2506.03179, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.19225","last_updated":"2025-06-24T01:19:56Z","snapshot_observed_at":"2026-08-07T21:07:46.308380Z","submitted_at":"2025-06-24T01:19:56Z","title":"Video-XL-2: Towards Very Long-Video Understanding Through Task-Aware KV Sparsification","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T23:13:08.790871Z"},"links":{"cited_paper":"/paper/2506.03179","citing_paper":"/paper/2506.19225"},"observation_digest":"sha256:d40fe9c7c6b41eacdc659ce5f80d24591db08af46fc3e1689c46fa2aba32f4b8","observation_id":"cde2b3d5-766a-4eb8-98d8-c27cdfbdd032","resolution":{"observed_at":"2026-08-06T23:13:08.790871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"cited_work":{"arxiv_id":"2506.03179","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2506.03179","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"arXiv preprint arXiv:2506.03179 (2025)","venue":null,"work_id":"53817525-c563-4f55-bfc8-866d08119aea","year":2025},"citing_paper":{"arxiv_id":"2604.27002","last_updated":"2026-04-29T04:21:21Z","snapshot_observed_at":"2026-07-06T23:12:33.898150Z","submitted_at":"2026-04-29T04:21:21Z","title":"Membership Inference Attacks Against Video Large Language Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-07T13:09:43.708043Z"},"links":{"cited_paper":"/paper/2506.03179","citing_paper":"/paper/2604.27002"},"observation_digest":"sha256:1cb49fe59a5f9e1608a2067c5c0f378077529c4a4da57b0ac5376ab6913a0d04","observation_id":"113347f8-e615-4b6b-879c-4c4c2cd4cb73","resolution":{"observed_at":"2026-05-12T09:01:26.252984Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2506.03179/citation-record","integrity":"/paper/2506.03179/integrity","json":"/paper/2506.03179/citation-record.json","paper":"/paper/2506.03179"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2303.08774","last_updated":"2024-03-04T06:01:33Z","snapshot_observed_at":"2026-08-07T07:30:12.213965Z","submitted_at":"2023-03-15T17:15:04Z","title":"GPT-4 Technical Report","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.08774","snapshot_observed_at":"2026-08-07T12:49:59.195327Z","title":"Gpt-4 technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.195327Z"},"links":{"cited_paper":"/paper/2303.08774","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:4715b1a40f31ac817e6e6af83c62f673aa9e9c2901cc4e2860914ea381273aae","observation_id":"7f4e4520-4d47-4e6c-9ad3-6aa286caff55","resolution":{"observed_at":"2026-08-07T12:49:59.195327Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.662820Z","title":"Generalised information and entropy measures in physics","venue":null,"work_id":"d4d6cc7e-c500-4e3d-9ea0-f17dcb73eb74","year":2009},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.283118Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:002a47b36a228f40be1f2b23f5e5739b15c0009d92817a69f8c30dc45ac2a116","observation_id":"3e26e7d7-d90a-4b3a-80c8-4e65fed986f4","resolution":{"observed_at":"2026-08-07T12:50:11.806842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.448225Z","title":"Is space-time attention all you need for video understanding? In ICML, volume 2, page 4, 2021","venue":null,"work_id":"c19c68c3-425c-4791-b51a-0108401cc7ab","year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.497540Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:bba5ee30d44dcfb3a8c8f89c5638354a8fec84ea4038024b4fd2eef2dcbe0050","observation_id":"66295b0f-1e58-4b10-b58a-04239842bd7b","resolution":{"observed_at":"2026-08-07T12:50:11.552437Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:59.711450Z","title":"Membership inference attacks from first principles","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.711450Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:86d129ecdc6372c2c6224ffc3d3869421f78bfcc820e6ff2899e8b94bfa76f78","observation_id":"ca8023f6-ddb4-4782-8b0d-e3e4b92d85ee","resolution":{"observed_at":"2026-08-07T12:49:59.711450Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.238699Z","title":"The secret sharer: Evaluating and testing unintended memorization in neural networks","venue":null,"work_id":"e1a1463d-8fce-4ade-8add-2d84cf8345c4","year":2019},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.847419Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:96f3161125d789102bef3209992930ca4852c99577ba297107957167f72d1dfa","observation_id":"7f7bbade-6c78-49e9-a16b-ea1612f1a136","resolution":{"observed_at":"2026-08-07T12:50:11.336760Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:49:59.978144Z","title":"Extracting training data from large language models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T12:49:59.978144Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:20e5b785de84930ef6f9a0fa735c3226ceddbba95a340dc497ae706835628835","observation_id":"49d8b062-eec5-49b1-b3d4-dddf34f31380","resolution":{"observed_at":"2026-08-07T12:49:59.978144Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.03051","last_updated":"2025-04-09T06:24:14Z","snapshot_observed_at":"2026-08-05T07:07:38.309470Z","submitted_at":"2024-10-04T00:13:54Z","title":"AuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.03051","snapshot_observed_at":"2026-08-07T12:50:00.159271Z","title":"Auroracap: Efficient, performant video detailed captioning and a new benchmark","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.159271Z"},"links":{"cited_paper":"/paper/2410.03051","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:52bcdba901086138c93b2715b23ef54821ed893618d376495d80af1e7bbc3261","observation_id":"14d775da-00a6-4a49-9a83-208061a1d3d8","resolution":{"observed_at":"2026-08-07T12:50:00.159271Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:00.355209Z","title":"Conceptual 12m: Pushing web-scale image-text pre-training to recognize long-tail visual concepts","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.355209Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:17fdb671cb049568dd20ca63074d8aedde884dffaa7d577a33da23cb29872787","observation_id":"1a926d2b-6c4a-42ad-b443-a274a01f0766","resolution":{"observed_at":"2026-08-07T12:50:00.355209Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:11.023940Z","title":"A hierarchical variational neural uncertainty model for stochastic video prediction","venue":null,"work_id":"06256295-31f2-4f7f-a9c8-fb6f7d8ca36e","year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.490679Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:30abfdb58ed11d0a7d68d3bb7c63e21a4b454ac835be7ebddf4b2543d69df3ad","observation_id":"5c524018-e614-41df-a7c8-69016aedef0b","resolution":{"observed_at":"2026-08-07T12:50:11.122114Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:10.820174Z","title":"Gan-leaks: A taxonomy of member- ship inference attacks against generative models","venue":null,"work_id":"e0c85045-0ab0-4913-b27e-1863f445fc67","year":2020},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.603354Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:254e580c7d861f7051d9c1ac90816b323cbf1f0b5d117453d8b06d651f495e64","observation_id":"208f3cfc-48b1-4ae0-9f88-27aaada04dd6","resolution":{"observed_at":"2026-08-07T12:50:10.941307Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:00.716534Z","title":"Sharegpt4v: Improving large multi-modal models with better captions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.716534Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:2f0b5e62df65e7fc62c7395a833666019aece30f0ff0c388eb005c556e6c09be","observation_id":"9699e74a-8253-45a0-8f46-374a6801760f","resolution":{"observed_at":"2026-08-07T12:50:00.716534Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:00.824379Z","title":"Vicuna: An open-source chatbot impressing gpt-4 with 90%* chatgpt quality","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.824379Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:6c8ba38da20d9204164e16682044add377ca0e35d75acf4fee976176b5aa97f9","observation_id":"9cdd9a72-425d-4abb-a4b3-13b24ef60617","resolution":{"observed_at":"2026-08-07T12:50:00.824379Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:10.659321Z","title":"A summary on entropy statistics","venue":null,"work_id":"cae0a2c5-8161-4e38-a42d-467c0ecfee9f","year":1995},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:00.941444Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:0ef1581e5eaded18be96ecdd534dd0f358022685eff258247e324eb3fc277097","observation_id":"0a5ec603-2d6f-4143-aae6-6c7838428c5b","resolution":{"observed_at":"2026-08-07T12:50:10.729548Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:10.460299Z","title":"Polynomial expansion for orientation and motion estimation","venue":null,"work_id":"1a85c75b-9d2e-4290-ba2a-3932be992909","year":2002},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.035208Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:7223c09360633d9f4bcedc4df6d1a8fabd93f361e2d85b3108a87179bee74cc5","observation_id":"2d7dc7d5-f617-466d-8f08-ff42a8edeb92","resolution":{"observed_at":"2026-08-07T12:50:10.521864Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:01.164509Z","title":"Dropout as a bayesian approximation: Representing model uncertainty in deep learning","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.164509Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:f92ec189931f3233ba695c8b995b048626d2dd0ff3af1a18b80a85a44de90cc4","observation_id":"b5ee8706-7825-40c1-ba9c-d76bb39cba8f","resolution":{"observed_at":"2026-08-07T12:50:01.164509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:01.258821Z","title":"Vision-language models for medical report generation and visual question answering: A review","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.258821Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:c477efcbb413be9a7e476bc3d16880dff6c4fb16b98ccb02b1f5d45cfdccd05b","observation_id":"1891a455-834b-49b7-ab0c-58a0b7554027","resolution":{"observed_at":"2026-08-07T12:50:01.258821Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1705.07663","last_updated":"2018-08-21T13:24:17Z","snapshot_observed_at":"2026-08-05T09:53:41.639197Z","submitted_at":"2017-05-22T11:05:06Z","title":"LOGAN: Membership Inference Attacks Against Generative Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1705.07663","snapshot_observed_at":"2026-08-07T12:50:01.377734Z","title":"Logan: Membership inference attacks against generative models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.377734Z"},"links":{"cited_paper":"/paper/1705.07663","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:839958dd2937c26790a870b3976aca698ef0024a595cbd0950daab8f64f00bc1","observation_id":"22f2957e-5b28-432c-9ea2-ae424f3c9fc6","resolution":{"observed_at":"2026-08-07T12:50:01.377734Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:01.534322Z","title":"Bliva: A simple multimodal llm for better handling of text-rich visual questions","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.534322Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:653dff17713d9bd0cf2d1b2469b60648b3146bf90c607e0cf64e5945fb98378e","observation_id":"c1adcd16-e2b9-4071-9cd5-6a3412f44dcf","resolution":{"observed_at":"2026-08-07T12:50:01.534322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.18624","last_updated":"2025-02-07T05:11:54Z","snapshot_observed_at":"2026-08-04T20:22:00.308928Z","submitted_at":"2025-01-27T05:44:58Z","title":"Membership Inference Attacks Against Vision-Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.18624","snapshot_observed_at":"2026-08-07T12:50:01.646953Z","title":"Membership inference attacks against vision-language models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.646953Z"},"links":{"cited_paper":"/paper/2501.18624","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:792f976abe74cc2955b393585508dbdf40ed68286083c411681d3379b04b9475","observation_id":"d7f5e69c-d339-41f5-b5cc-32a5d117b1c6","resolution":{"observed_at":"2026-08-07T12:50:01.646953Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:01.782739Z","title":"Blip-2: Bootstrapping language-image pre-training with frozen image encoders and large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.782739Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:72b45c79352f87b5de372f5ce5e88e1f586c4752e7a94e54f7f71915d31c0443","observation_id":"1ecb97f7-8d70-47be-b9e0-06a0c996837f","resolution":{"observed_at":"2026-08-07T12:50:01.782739Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.06355","last_updated":"2024-01-04T02:06:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-05-10T17:59:04Z","title":"VideoChat: Chat-Centric Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.06355","snapshot_observed_at":"2026-08-07T12:50:01.880477Z","title":"Videochat: Chat-centric video understanding","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:01.880477Z"},"links":{"cited_paper":"/paper/2305.06355","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:5d71e35224149b0a25b8ff4977c279f5a7f1b1a89d12528258e9a1cf607785d3","observation_id":"5affa91c-1097-4287-9971-fc2a790710a4","resolution":{"observed_at":"2026-08-07T12:50:01.880477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.15796","last_updated":"2024-11-24T11:46:59Z","snapshot_observed_at":"2026-07-06T19:56:08.504922Z","submitted_at":"2024-11-24T11:46:59Z","title":"Data Lineage Inference: Uncovering Privacy Vulnerabilities of Dataset Pruning","version":1},"cited_work":{"arxiv_id":"2411.15796","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.15796","snapshot_observed_at":"2026-08-07T12:50:07.058242Z","title":"Data Lineage Inference: Uncovering Privacy Vulnerabilities of Dataset Pruning","venue":"cs.CR","work_id":"af92504b-a29c-4c42-831b-12e3c9c5ae91","year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.020835Z"},"links":{"cited_paper":"/paper/2411.15796","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:412571bdc756fd9e98e1ec494eff431b04fc118ef6a9ec123346dbb29b33df45","observation_id":"5da2f132-cbb0-4740-9dc6-055d0af091b1","resolution":{"observed_at":"2026-08-07T12:50:07.109278Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:02.148376Z","title":"Membership inference attacks against large vision-language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.148376Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:2f5cd514da8053d2ab8777941bab7c2e1447424f4ee0bb612e8595d05108838c","observation_id":"d7fcc0d1-d3d9-4499-99ba-d5bf76a85fa0","resolution":{"observed_at":"2026-08-07T12:50:02.148376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:10.145999Z","title":"Next-qa: Next phase of question answering to explaining tem- poral actions","venue":null,"work_id":"98ac3d90-0fed-4e17-ae1e-352e1b58cf86","year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.275954Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:3c44580522cef36747948184a24742ee17ba80710b9bbcbc8ee56bfdec2778ab","observation_id":"15b27c79-583b-4983-9629-be85bee2703c","resolution":{"observed_at":"2026-08-07T12:50:10.259861Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:02.442463Z","title":"Improved baselines with visual instruction tuning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.442463Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:bad47e3fe51734ac6014342dd8bba3705fb96e0a53f1df3e985ff7278ce59236","observation_id":"b411a6af-f3a4-40e2-aef6-bbdf3f5a52a3","resolution":{"observed_at":"2026-08-07T12:50:02.442463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:02.525025Z","title":"Llava-next: Improved reasoning, ocr, and world knowledge, January 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.525025Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:d42a41bc0b7418a71ae46c488c0c9e664a649abf9b949383642acc95dc601c75","observation_id":"ecb9d7da-ac86-42c7-b9aa-2e9c4884b68c","resolution":{"observed_at":"2026-08-07T12:50:02.525025Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.967334Z","title":"St-llm: Large language models are effective temporal learners","venue":null,"work_id":"f0a4a853-4798-4c8a-ba37-4695ebf13779","year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.650138Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:6915b4aecee8db09c0f14164a854f98a94aa5dc88c158e631e5f3658f1d94c57","observation_id":"c79afcb2-883b-4e35-98be-2d25af95dbe6","resolution":{"observed_at":"2026-08-07T12:50:10.065850Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.00476","last_updated":"2024-06-03T04:13:39Z","snapshot_observed_at":"2026-08-04T21:17:37.211833Z","submitted_at":"2024-03-01T12:02:19Z","title":"TempCompass: Do Video LLMs Really Understand Videos?","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.00476","snapshot_observed_at":"2026-08-07T12:50:02.767971Z","title":"Tempcompass: Do video llms really understand videos? arXiv preprint arXiv:2403.00476, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.767971Z"},"links":{"cited_paper":"/paper/2403.00476","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:8dc91a11ae226cc788c674459457df3ec58c0a4dd64dbf646c25efa58a99687c","observation_id":"a2044a25-f7d4-4fb3-9665-8c2f0ab4490f","resolution":{"observed_at":"2026-08-07T12:50:02.767971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14640","last_updated":"2025-05-20T17:26:32Z","snapshot_observed_at":"2026-08-07T15:28:25.992115Z","submitted_at":"2025-05-20T17:26:32Z","title":"VideoEval-Pro: Robust and Realistic Long Video Understanding Evaluation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14640","snapshot_observed_at":"2026-08-07T12:50:02.846860Z","title":"Videoeval-pro: Robust and realistic long video understanding evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.846860Z"},"links":{"cited_paper":"/paper/2505.14640","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:d1ecaeeb3ad772ce07f827ec448163c69318871c2a73fddd7ea87ff68a8b26ab","observation_id":"a0e8be73-74c8-40ed-ac7e-74a5cf6f213b","resolution":{"observed_at":"2026-08-07T12:50:02.846860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2106.11384","last_updated":"2021-06-21T19:37:06Z","snapshot_observed_at":"2026-07-06T11:21:30.713389Z","submitted_at":"2021-06-21T19:37:06Z","title":"Membership Inference on Word Embedding and Beyond","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2106.11384","snapshot_observed_at":"2026-08-07T12:50:02.921582Z","title":"Membership inference on word embedding and beyond","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.921582Z"},"links":{"cited_paper":"/paper/2106.11384","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:7596002c8eb45028357c9ed9bf77306716af1ee02efc702a8265af1e74ec73d8","observation_id":"a5ebe86a-f4aa-45d0-8029-110c21ad2e9d","resolution":{"observed_at":"2026-08-07T12:50:02.921582Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.05424","last_updated":"2024-06-10T01:36:53Z","snapshot_observed_at":"2026-07-06T15:40:24.127663Z","submitted_at":"2023-06-08T17:59:56Z","title":"Video-ChatGPT: Towards Detailed Video Understanding via Large Vision and Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.05424","snapshot_observed_at":"2026-08-07T12:50:02.944973Z","title":"Video-chatgpt: Towards detailed video understanding via large vision and language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:02.944973Z"},"links":{"cited_paper":"/paper/2306.05424","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:a491da67eb0ca8de8b9e0d719a7768cd2737bd0b5771930c6e3c79848b9e30c6","observation_id":"3bca8670-5e05-4c3b-8560-fd380795588a","resolution":{"observed_at":"2026-08-07T12:50:02.944973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:03.043359Z","title":"Expanding language-image pretrained models for general video recognition","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.043359Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:2c1bb244dd1520162ece68298f0851fc2da5a098dd6d84901913bcb5cf20e263","observation_id":"101ecbd6-fda6-4c6b-975c-f434139abf21","resolution":{"observed_at":"2026-08-07T12:50:03.043359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.769176Z","title":"Slowfocus: Enhancing fine-grained temporal understanding in video llm","venue":null,"work_id":"50053704-de78-454b-b2c2-492e77a50663","year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.201275Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:0ae279d7c98d4e590199899383bfb041522ff000e3c39af6ae78acb08c3b63d4","observation_id":"5be1f143-d460-424e-adde-14d4427f23cf","resolution":{"observed_at":"2026-08-07T12:50:09.857404Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.571874Z","title":"Learning latent subevents in activity videos using temporal attention filters","venue":null,"work_id":"9b7b3a99-efda-499a-842c-471da2d31f4f","year":2017},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.285450Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:806ca90a783511eb1b18702acd1d2406672d4a7b65bfe39b76229d12bfc019d6","observation_id":"fd8a5bad-f8e3-47bf-bab1-f11070dce1b4","resolution":{"observed_at":"2026-08-07T12:50:09.666613Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.395384Z","title":"Fine-tuned clip models are efficient video learners","venue":null,"work_id":"13e8d142-6eea-4d28-bb59-0be16482ecc1","year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.376117Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:584936450de40c32346bafe4fb67a8bc7ed7c32cb00f3ea90bf77b29d0b2795b","observation_id":"190b3730-464f-4765-aa75-27356f97060b","resolution":{"observed_at":"2026-08-07T12:50:09.475271Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2405.08813","last_updated":"2024-10-21T03:08:08Z","snapshot_observed_at":"2026-08-07T17:42:30.374808Z","submitted_at":"2024-05-14T17:59:02Z","title":"CinePile: A Long Video Question Answering Dataset and Benchmark","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.08813","snapshot_observed_at":"2026-08-07T12:50:03.465772Z","title":"Cinepile: A long video question answering dataset and benchmark","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.465772Z"},"links":{"cited_paper":"/paper/2405.08813","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:68276437eca97c53098201ad03cd42507f0ce74b9754c80b2cb35baa299e243a","observation_id":"b5a9eed2-063f-4369-83c6-f8cdb5c0e94f","resolution":{"observed_at":"2026-08-07T12:50:03.465772Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.183036Z","title":"On measures of entropy and information","venue":null,"work_id":"0388688a-99a2-4f80-b2a3-e1829329fa29","year":1961},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.561224Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:4bfa12cae6180d7dbf4a39f67f6f0bfd0f5b6570877d23f60d6f164a41d76c11","observation_id":"26932e13-46af-4771-9da3-cfb109305d63","resolution":{"observed_at":"2026-08-07T12:50:09.290443Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1806.01246","last_updated":"2018-12-14T19:39:43Z","snapshot_observed_at":"2026-08-08T03:39:28.408433Z","submitted_at":"2018-06-04T17:38:42Z","title":"ML-Leaks: Model and Data Independent Membership Inference Attacks and Defenses on Machine Learning Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1806.01246","snapshot_observed_at":"2026-08-07T12:50:03.631859Z","title":"Ml-leaks: Model and data independent membership inference attacks and defenses on machine learning models","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.631859Z"},"links":{"cited_paper":"/paper/1806.01246","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:b43ec11813ae7b87c41e6724e6373d7870704dc3e856083bbafbd0314490762f","observation_id":"705e65bc-7f65-4da8-87d8-0dc7e92d5a44","resolution":{"observed_at":"2026-08-07T12:50:03.631859Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2111.02114","last_updated":"2021-11-03T10:16:39Z","snapshot_observed_at":"2026-08-02T08:12:49.547570Z","submitted_at":"2021-11-03T10:16:39Z","title":"LAION-400M: Open Dataset of CLIP-Filtered 400 Million Image-Text Pairs","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2111.02114","snapshot_observed_at":"2026-08-07T12:50:03.733468Z","title":"Laion-400m: Open dataset of clip-filtered 400 million image-text pairs","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.733468Z"},"links":{"cited_paper":"/paper/2111.02114","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:ce618c5ec7f56f06435a8cb21708bee86f41550c2a01e10f22a5c06a3fc0edf8","observation_id":"be25302d-63d5-4bc9-b342-40a1639baf46","resolution":{"observed_at":"2026-08-07T12:50:03.733468Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:03.803803Z","title":"A mathematical theory of communication","venue":null,"work_id":null,"year":1948},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.803803Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:8da496e84aa625c3da1736eaa69b4f8746953c0023892caa32d976fb0f238deb","observation_id":"3a116c7b-1442-465e-b999-c4128a17f05a","resolution":{"observed_at":"2026-08-07T12:50:03.803803Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:09.031619Z","title":"New non-additive measures of entropy for discrete probability distributions","venue":null,"work_id":"1014e721-c5cb-4098-aedf-d82a513b3842","year":1975},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.895255Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:93ae87b7e222cbc4a43aa59492607da6e25fb112cf60432b8f73cdd1beb3ef63","observation_id":"1e88c572-da1e-4a96-a1b2-e0fade9e3c6a","resolution":{"observed_at":"2026-08-07T12:50:09.105033Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.16789","last_updated":"2024-03-09T22:26:06Z","snapshot_observed_at":"2026-07-06T16:38:29.188225Z","submitted_at":"2023-10-25T17:21:23Z","title":"Detecting Pretraining Data from Large Language Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.16789","snapshot_observed_at":"2026-08-07T12:50:03.989883Z","title":"Detecting pretraining data from large language models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:03.989883Z"},"links":{"cited_paper":"/paper/2310.16789","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:ff166ce190bf554cafcbb509e48d2a34114869d7b223478e23475f4c81164093","observation_id":"aa40c5ee-0017-46be-99b5-092d1aa6f33f","resolution":{"observed_at":"2026-08-07T12:50:03.989883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:04.052538Z","title":"Membership inference attacks against machine learning models","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.052538Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:884bde8ba7a1166650c5c544a6948c531103d816a07096f477db438280451eca","observation_id":"0b9a2264-292f-44ec-a314-324191e1cc0b","resolution":{"observed_at":"2026-08-07T12:50:04.052538Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.21682","last_updated":"2025-06-05T18:59:02Z","snapshot_observed_at":"2026-08-07T15:57:54.245015Z","submitted_at":"2025-04-30T14:19:29Z","title":"Visual Text Processing: A Comprehensive Review and Unified Evaluation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.21682","snapshot_observed_at":"2026-08-07T12:50:04.127536Z","title":"Visual text processing: A comprehensive review and unified evaluation","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.127536Z"},"links":{"cited_paper":"/paper/2504.21682","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:0e506832d4d979787845124ebab779c4dd19bf3e748e0d8990abe0104c05e942","observation_id":"4573f7fc-2348-47f0-8f17-e32ee76a36e2","resolution":{"observed_at":"2026-08-07T12:50:04.127536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.14485","last_updated":"2024-12-10T12:45:31Z","snapshot_observed_at":"2026-07-06T19:19:28.953455Z","submitted_at":"2024-09-22T15:13:31Z","title":"Video-XL: Extra-Long Vision Language Model for Hour-Scale Video Understanding","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.14485","snapshot_observed_at":"2026-08-07T12:50:04.246155Z","title":"Video-xl: Extra-long vision language model for hour-scale video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.246155Z"},"links":{"cited_paper":"/paper/2409.14485","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:ab3d2148bcb078c6b2b5be02296539b62f71cbb85e48a8c82b3e46177eeefeaf","observation_id":"c8017646-7848-455d-855d-be4096fd1aca","resolution":{"observed_at":"2026-08-07T12:50:04.246155Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:04.343404Z","title":"Two-stream convolutional networks for action recognition in videos","venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.343404Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:5fbbc29849c45e92e44ebef26feb709bb8032f61e828719587cecbc2ccc7eed9","observation_id":"2e2d68cb-e4c0-4007-957b-597d2bcba0a6","resolution":{"observed_at":"2026-08-07T12:50:04.343404Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:08.874150Z","title":"Information leakage in embedding models","venue":null,"work_id":"935bc873-9e84-493e-9147-02b24323d20b","year":2020},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.467494Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:eaac7a9df3db6adf133484339007ee275dc9de9c0e0e88a4e37e3c7174c23bc9","observation_id":"3e1c3333-340c-46ec-8aeb-59f5639704b8","resolution":{"observed_at":"2026-08-07T12:50:08.940596Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:04.581764Z","title":"Machine learning models that remember too much","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.581764Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:a502c354138453ebb897e4021c94a0548e7f7a956f5f218f171b274bfdefb950","observation_id":"6e2ae5dc-8272-44cb-9f75-837c48bf77bb","resolution":{"observed_at":"2026-08-07T12:50:04.581764Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:08.651900Z","title":"Systematic evaluation of privacy risks of machine learning models","venue":null,"work_id":"e03e2ddc-7cd4-4242-b12d-02d1f2677d6b","year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.718253Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:2b40837316607c3d245f80f3b06306c5676fd40483f52c3c532f3cc273474e75","observation_id":"af2f5f85-d54b-4bb6-b43f-8c0e8f3bef2d","resolution":{"observed_at":"2026-08-07T12:50:08.767703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:08.479706Z","title":"Membership inference attacks against adversari- ally robust deep learning models","venue":null,"work_id":"8fb90e62-d402-4bd3-95a4-c9613bf08c4d","year":2019},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.873747Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:04b409d86de9881703c1e14122bc43188efa86dadc7eebaa0692ee89596a7a07","observation_id":"f186be7a-2ab3-4ac5-8313-7f69beb88b20","resolution":{"observed_at":"2026-08-07T12:50:08.568425Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:08.273862Z","title":"On generalized information measures and their applications","venue":null,"work_id":"64d32efa-aaae-4242-895d-5fa9e8eb2f7c","year":1989},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:04.999000Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:b82ef618f403807cf9c1ed12f8e7e8b15c96706473b67ca51214bc97984f7180","observation_id":"6e6be34f-de80-4c2f-8990-3be96fac9342","resolution":{"observed_at":"2026-08-07T12:50:08.338855Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09288","last_updated":"2023-07-19T17:08:59Z","snapshot_observed_at":"2026-08-07T12:56:43.323460Z","submitted_at":"2023-07-18T14:31:57Z","title":"Llama 2: Open Foundation and Fine-Tuned Chat Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09288","snapshot_observed_at":"2026-08-07T12:50:05.147168Z","title":"Llama 2: Open foundation and fine-tuned chat models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.147168Z"},"links":{"cited_paper":"/paper/2307.09288","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:68b513bc0926a100492003abee4f3d1db1118d3e40655c7ea0e2a394e52023fa","observation_id":"5d3dac5a-6b4e-497b-95e5-5ecde0569248","resolution":{"observed_at":"2026-08-07T12:50:05.147168Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:08.060667Z","title":"Possible generalization of boltzmann-gibbs statistics","venue":null,"work_id":"b5383bee-8138-49f9-b14f-e986af54c673","year":1988},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.212429Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:68836fdaf2bb74db4decab7a9abad00b25e20ce930d550fa310862c49dde5df1","observation_id":"a55d195b-e3c1-4842-a420-b368c67e69e8","resolution":{"observed_at":"2026-08-07T12:50:08.185744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.12830","last_updated":"2024-04-30T23:20:41Z","snapshot_observed_at":"2026-07-06T17:47:06.731501Z","submitted_at":"2024-03-19T15:37:27Z","title":"Towards Lifecycle Unlearning Commitment Management: Measuring Sample-level Approximate Unlearning Completeness","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.12830","snapshot_observed_at":"2026-08-07T12:50:05.293392Z","title":"Towards lifecycle unlearn- ing commitment management: Measuring sample-level approximate unlearning completeness","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.293392Z"},"links":{"cited_paper":"/paper/2403.12830","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:916d680392dab8af64b473ed72550626fa470c01b7592b5fd4ccb6f548885656","observation_id":"e75b7c71-5106-4d83-bd6f-afcb7403748e","resolution":{"observed_at":"2026-08-07T12:50:05.293392Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:05.379397Z","title":"Cogvlm: Visual expert for pretrained language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.379397Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:3a089a1520e7a22635196b8758297259a26b13d7c801cc0fa132e830180b6263","observation_id":"d0600a01-95c9-4990-8fd2-14402013aeab","resolution":{"observed_at":"2026-08-07T12:50:05.379397Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:07.842560Z","title":"Videoagent: Long-form video understanding with large language model as agent","venue":null,"work_id":"de496c45-4b23-4d2e-aa6d-78ea81d9373e","year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.500963Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:cf2b9750cba82c81b9bc7f59fad2143b6240feeddc1b6ce2a742e388b3a62170","observation_id":"a5491a5e-aa1a-4870-b10c-98185536397c","resolution":{"observed_at":"2026-08-07T12:50:07.985051Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.19338","last_updated":"2025-08-31T10:28:19Z","snapshot_observed_at":"2026-08-07T16:39:23.738988Z","submitted_at":"2025-03-25T04:11:47Z","title":"Membership Inference Attacks on Large-Scale Models: A Survey","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.19338","snapshot_observed_at":"2026-08-07T12:50:05.586426Z","title":"Membership inference attacks on large-scale models: A survey","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.586426Z"},"links":{"cited_paper":"/paper/2503.19338","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:87858421243f5ca9ec7624da7208a163ede0ca9cedf3402e98c2f85413b1f90d","observation_id":"0ec80a0b-0802-449e-965a-9f21b2726c38","resolution":{"observed_at":"2026-08-07T12:50:05.586426Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:07.571444Z","title":"Optimizing video prediction via video frame interpola- tion","venue":null,"work_id":"9294d0c2-9029-4bec-95f2-bb8bf2465b1a","year":2022},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.725361Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:3ec013141b6d997b4fae03ad74a130fdc774b3f8874b640d3723f83749109fae","observation_id":"a56eb976-f0d0-477e-9da7-70681236dcd4","resolution":{"observed_at":"2026-08-07T12:50:07.662811Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:05.811536Z","title":"Privacy risk in machine learning: Analyzing the connection to overfitting","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.811536Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:f14f1aa0b8d98a0c38c157672ab04ac4d5b30dfffaecc35fb617d8295cd5ceeb","observation_id":"7fd37cb5-b0a3-42f1-83bc-ce00b0bbe0f2","resolution":{"observed_at":"2026-08-07T12:50:05.811536Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.09149","last_updated":"2025-06-20T07:15:14Z","snapshot_observed_at":"2026-08-07T17:10:47.806172Z","submitted_at":"2025-03-12T08:23:32Z","title":"Memory-enhanced Retrieval Augmentation for Long Video Understanding","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.09149","snapshot_observed_at":"2026-08-07T12:50:05.895161Z","title":"Memory-enhanced retrieval augmentation for long video understanding","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:05.895161Z"},"links":{"cited_paper":"/paper/2503.09149","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:4a8864a2b669dc9e8507379d9d93460b57f11e99f052e99e9327d705185e23d6","observation_id":"bcff9749-0c0c-4a8e-955d-c8f53bf5c8f9","resolution":{"observed_at":"2026-08-07T12:50:05.895161Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2312.03262","last_updated":"2024-06-12T09:02:47Z","snapshot_observed_at":"2026-08-06T10:49:48.033035Z","submitted_at":"2023-12-06T03:18:49Z","title":"Low-Cost High-Power Membership Inference Attacks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.03262","snapshot_observed_at":"2026-08-07T12:50:06.019851Z","title":"Low-cost high-power membership inference attacks","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.019851Z"},"links":{"cited_paper":"/paper/2312.03262","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:7bd0a160965ca15e2f28e87862f46c099d1cd31119a42dfa91554974ed1784ce","observation_id":"a6cd3d11-bbff-4cdd-bc20-67b0f99bd391","resolution":{"observed_at":"2026-08-07T12:50:06.019851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:07.364576Z","title":"Understanding deep learning (still) requires rethinking generalization","venue":null,"work_id":"e3d2ad56-5e52-4f1f-80c9-76e3bf490aac","year":2021},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.095288Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:f0585a06e3dd188310c739d5ed4f33e442549caf3585f3afce649ece81d8495e","observation_id":"0d9f2b91-34d5-47dc-81e4-2b7dbe25edbd","resolution":{"observed_at":"2026-08-07T12:50:07.453959Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.02936","last_updated":"2025-02-12T04:41:34Z","snapshot_observed_at":"2026-08-06T22:02:50.460833Z","submitted_at":"2024-04-03T04:25:01Z","title":"Min-K%++: Improved Baseline for Detecting Pre-Training Data from Large Language Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.02936","snapshot_observed_at":"2026-08-07T12:50:06.177607Z","title":"Min-k%++: Improved baseline for detecting pre-training data from large language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.177607Z"},"links":{"cited_paper":"/paper/2404.02936","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:080349286fd02b4bc423cbd5b136c12e01590ab2ddfb97a144106e132d611b7c","observation_id":"548de2d1-4350-4c21-b212-3e1c67f612a8","resolution":{"observed_at":"2026-08-07T12:50:06.177607Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.16852","last_updated":"2024-07-01T02:59:29Z","snapshot_observed_at":"2026-08-07T09:52:45.942315Z","submitted_at":"2024-06-24T17:58:06Z","title":"Long Context Transfer from Language to Vision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.16852","snapshot_observed_at":"2026-08-07T12:50:06.285354Z","title":"Long context transfer from language to vision","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.285354Z"},"links":{"cited_paper":"/paper/2406.16852","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:900bb26abc82d7fdee1d8df3445a3dde712628ef6921bffc46806ca067c8dfe2","observation_id":"7090f9e5-e826-48d2-a982-117d9ec7574c","resolution":{"observed_at":"2026-08-07T12:50:06.285354Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:06.350478Z","title":"Instruction tuning for large language models: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.350478Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:3d8b0eda922aa4936b6ef26356a443da4e982ecd5d389969977ddc3a8231bc86","observation_id":"c28e97a8-b5e4-47bf-a37e-5b6f3c93033b","resolution":{"observed_at":"2026-08-07T12:50:06.350478Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:06.454260Z","title":"Llava-next: A strong zero-shot video understanding model, April 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.454260Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:4c84bce52f5711b4bc7e8b83b2ba4c19113a69983ce948d222927033b14f9836","observation_id":"34b4344b-0985-4f43-8c09-eb8538e5b39d","resolution":{"observed_at":"2026-08-07T12:50:06.454260Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04264","last_updated":"2025-01-01T15:53:58Z","snapshot_observed_at":"2026-08-03T20:38:36.602554Z","submitted_at":"2024-06-06T17:09:32Z","title":"MLVU: Benchmarking Multi-task Long Video Understanding","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04264","snapshot_observed_at":"2026-08-07T12:50:06.526660Z","title":"Mlvu: A comprehensive benchmark for multi-task long video understanding","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.526660Z"},"links":{"cited_paper":"/paper/2406.04264","citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:44a7dcfb838d9d75d7d702966c7bb02947861bad29d2a30e739f1754cb3535f2","observation_id":"f2ccfd2b-e414-47d7-a3be-620b054f5142","resolution":{"observed_at":"2026-08-07T12:50:06.526660Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T12:50:07.222048Z","title":"A survey on deep learning technique for video segmentation","venue":null,"work_id":"1582528c-0269-4a25-ad60-0c5113956a85","year":2022},"citing_paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T12:50:06.708410Z"},"links":{"citing_paper":"/paper/2506.03179"},"observation_digest":"sha256:490cef3376288971f01a44553c2f3200c023ddcf307d8719754d02319ed57631","observation_id":"0bcd2431-6ade-4903-811b-cce29a24883d","resolution":{"observed_at":"2026-08-07T12:50:07.275639Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-08T06:32:00.761636+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2506.03179","last_updated":"2025-05-29T13:17:25Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T00:26:20.360231Z","submitted_at":"2025-05-29T13:17:25Z","title":"Vid-SME: Membership Inference Attacks against Large Video Understanding Models"},"reference_resolution":{"displayed":68,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":1,"verified_fuzzy":23},"total_outbound_references":68},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 68 of 68 outbound references and 2 inbound Pith citation observations for arXiv:2506.03179."}