{"as_of":"2026-08-09T10:54:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1805ff967dcddf45f86a6ef420ae4da48e245024f33872f853d3a120b55c3717","coverage":[{"denominator":63,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":63,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T20:23:57.944190Z","state":"measured"},{"denominator":63,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":63,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2511.20295/citation-record","integrity":"/paper/2511.20295/integrity","json":"/paper/2511.20295/citation-record.json","paper":"/paper/2511.20295"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2501.03575","last_updated":"2025-07-09T19:35:31Z","snapshot_observed_at":"2026-08-03T00:21:10.886100Z","submitted_at":"2025-01-07T06:55:50Z","title":"Cosmos World Foundation Model Platform for Physical AI","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.03575","snapshot_observed_at":"2026-08-03T20:23:51.494699Z","title":"Cosmos world foun- dation model platform for physical ai.arXiv preprint arXiv:2501.03575, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:51.494699Z"},"links":{"cited_paper":"/paper/2501.03575","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:c85281323c1feb9ff4dc7c10f8b77a828a097b1b38576c3345c621b1f8ef393b","observation_id":"711f6b55-66d8-4b88-a717-2556747a3ae3","resolution":{"observed_at":"2026-08-03T20:23:51.494699Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:51.611447Z","title":"Diffusion visual counterfactual explana- tions.Advances in Neural Information Processing Systems, 35:364–377, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:51.611447Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:7b64f5c218d38d40d832c5f4983a3134a79694416fd32b1b7757fe9631f4a472","observation_id":"7ed6ab5a-c8fa-434b-97f9-2a0326f97418","resolution":{"observed_at":"2026-08-03T20:23:51.611447Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:51.769909Z","title":"Dig-in: Diffusion guidance for investigating networks- uncovering classifier differences neuron visualisations and visual counterfactual explanations","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:51.769909Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:5f5c951352662c695951246f095177da46a5168862f6f8f71ff1ec99c9614558","observation_id":"7e9d96f5-0739-485e-a7d0-1a14bc3a9b6e","resolution":{"observed_at":"2026-08-03T20:23:51.769909Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:51.971858Z","title":"Sparse visual counterfac- tual explanations in image space","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:51.971858Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:1d5e0ed0a73b3f110bac33334a43b955cf4b69b53022f2428b1de01a4278f7eb","observation_id":"c23f1a26-d6f7-4342-b7af-72b526e91c81","resolution":{"observed_at":"2026-08-03T20:23:51.971858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:52.134031Z","title":"Quo vadis, action recognition? a new model and the kinetics dataset","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:52.134031Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:81ecf868cb345e320e5d3c8155a81191b46035af6b2ec056d533ca8a00c69941","observation_id":"558b5dbb-fe08-4791-b8d4-6264da04744d","resolution":{"observed_at":"2026-08-03T20:23:52.134031Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:52.339045Z","title":"A frank-wolfe framework for efficient and effective adver- sarial attacks","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:52.339045Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:2cc31515caf8ab3d0362ac929ccaec09ccb3ccd9a64d8547ed73011df0ee90f4","observation_id":"680da456-9a73-4d8e-8bba-74dc3b8a7fd7","resolution":{"observed_at":"2026-08-03T20:23:52.339045Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:52.517782Z","title":"Learning temporal coherence via self- supervision for gan-based video generation.ACM Transac- tions on Graphics (TOG), 39(4):75–1, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:52.517782Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:225de4a904e54d543f00253a091d636997fd189eb00c8fb4834578249b3a5b5d","observation_id":"6a155a07-438d-408b-8e5a-c180b5b5fd18","resolution":{"observed_at":"2026-08-03T20:23:52.517782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:52.700938Z","title":"Diffusion models beat gans on image synthesis.Advances in neural informa- tion processing systems, 34:8780–8794, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:52.700938Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:fcecf5c011f087bdb421a36eba1ca9250fea65d7522f1d4a0fe8d373660c5b58","observation_id":"fcf16372-cc04-429e-802b-a0f4b2332eb4","resolution":{"observed_at":"2026-08-03T20:23:52.700938Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:52.812648Z","title":"Relative State","venue":null,"work_id":null,"year":1957},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:52.812648Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:a52b6b58141f674e90eeadd770a497668750e2a8fc1115cb2590c02faf7e972c","observation_id":"b3a15108-faf1-40d1-9316-4dcf8fa32f08","resolution":{"observed_at":"2026-08-03T20:23:52.812648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:52.962373Z","title":"Robust physical-world attacks on deep learning visual classification","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:52.962373Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:8a1b84e3a5ed6c8efb3fb14c909b731b4dd413b1d47ed980a81e92303da01a63","observation_id":"8af35267-beb6-4ea5-8ecc-1443d657881c","resolution":{"observed_at":"2026-08-03T20:23:52.962373Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06668","last_updated":"2023-10-10T14:42:34Z","snapshot_observed_at":"2026-07-06T16:30:33.889293Z","submitted_at":"2023-10-10T14:42:34Z","title":"Latent Diffusion Counterfactual Explanations","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06668","snapshot_observed_at":"2026-08-03T20:23:53.044339Z","title":"Latent diffusion counterfactual explanations.arXiv preprint arXiv:2310.06668, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.044339Z"},"links":{"cited_paper":"/paper/2310.06668","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:ba7f206895335a2425a3c2883f1c5af84f4c31fe1823f846e474e4249e900334","observation_id":"a3750451-37dd-4e18-b974-abf86d1ba90a","resolution":{"observed_at":"2026-08-03T20:23:53.044339Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:53.146012Z","title":"Tex- ture synthesis using convolutional neural networks.Ad- vances in neural information processing systems, 28, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.146012Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:0ff8944a71ab313d511dca941c84919c1e7e06c1231902784e3ee395903ac525","observation_id":"844a7516-7bd6-4260-9b34-45522688ee6f","resolution":{"observed_at":"2026-08-03T20:23:53.146012Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1508.06576","last_updated":"2015-09-02T08:24:59Z","snapshot_observed_at":"2026-07-06T04:27:45.692332Z","submitted_at":"2015-08-26T17:14:42Z","title":"A Neural Algorithm of Artistic Style","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1508.06576","snapshot_observed_at":"2026-08-03T20:23:53.237218Z","title":"A neural algorithm of artistic style.arXiv preprint arXiv:1508.06576, 2015","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.237218Z"},"links":{"cited_paper":"/paper/1508.06576","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:5d5d82a372382b16563f0251975a2032c8ac2f446ab80d9d20f90eebb77224e0","observation_id":"3dcc1618-c66c-4cf2-a1ae-36c1cc992ae5","resolution":{"observed_at":"2026-08-03T20:23:53.237218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:53.364436Z","title":"Counterfactual explanations and how to find them: literature review and benchmarking.Data Mining and Knowledge Discovery, 38(5):2770–2824, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.364436Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:78ebee8f33fa5b7595cc627bdff4696eba40d9b82ed72f0f3d9466d2ae375019","observation_id":"8647e0b2-a2a9-4aeb-a969-6bf82a432218","resolution":{"observed_at":"2026-08-03T20:23:53.364436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:53.476317Z","title":"Glide: a new approach for rapid, accurate dock- ing and scoring","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.476317Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:92e39647bbe3a687c1cf87daaf2af751d1c28eb8164d10205d5efc80d131a90f","observation_id":"8d8aae57-05b3-40c5-9386-bb8d903467a7","resolution":{"observed_at":"2026-08-03T20:23:53.476317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:53.565756Z","title":"Deep residual learning for image recognition","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.565756Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:1a92b5c5b93705b5d0e1c8b1ff21367f865921fa4976747486c1af090f8dfbca","observation_id":"edde2a67-0edb-4638-9788-0ec6d98976ed","resolution":{"observed_at":"2026-08-03T20:23:53.565756Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:53.635391Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium.Advances in neural information processing systems, 30, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.635391Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:7274d18eb594f805fc4a9c64361844547d802c190ea50b19c75ac5f640236781","observation_id":"61f4b6e2-a7b0-4043-952e-8e92ae676295","resolution":{"observed_at":"2026-08-03T20:23:53.635391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:53.722967Z","title":"Denoising dif- fusion probabilistic models.Advances in neural information processing systems, 33:6840–6851, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.722967Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:a43a3291ac8d2507ffe56e4699353c2ac36559714fdab34e2f748c0ef5e5d81f","observation_id":"6923a810-b244-4edb-ab7b-adfc49309169","resolution":{"observed_at":"2026-08-03T20:23:53.722967Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:53.818210Z","title":"An introduction to flow matching and diffusion models.arXiv preprint arXiv:2506.02070, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.818210Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:f9200f650c991a4ecf7eebb0ee39d99b0cdb38b1a6d259f5c38b6a981fbeb897","observation_id":"0b52c5c4-9619-4053-afc7-0372adb0d470","resolution":{"observed_at":"2026-08-03T20:23:53.818210Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:53.840109Z","title":"Lora: Low-rank adaptation of large language models.ICLR, 1(2):3, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.840109Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:d74115c6b41097b9ca060131c7b2b328a05a9531e56a5a4be03685c67db94e10","observation_id":"5d7525f6-c639-463e-9e05-ecff24315f4b","resolution":{"observed_at":"2026-08-03T20:23:53.840109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:53.846295Z","title":"Steex: steering counter- factual explanations with semantics","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.846295Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:7cf8e3afc1a839fce360f6ca145f6309d8b361bdcfe79d728c5c2ec65fbc828b","observation_id":"7b257024-ca68-4f0e-8528-d32f2fa33c99","resolution":{"observed_at":"2026-08-03T20:23:53.846295Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:53.986609Z","title":"Diffu- sion models for counterfactual explanations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:53.986609Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:c3d98766885615b4c0c3e4b5a52f3da87c7dc9d7583a052b326f07028a7d863c","observation_id":"05081725-50aa-4ec5-96c3-7d4ade4dec95","resolution":{"observed_at":"2026-08-03T20:23:53.986609Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:54.154679Z","title":"Ad- versarial counterfactual visual explanations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:54.154679Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:b62e1cdd1cb7c569a0feddedc40a6ce0d15fb8164dd36c2ce89783db8898523c","observation_id":"7d61a9dc-4d56-4a2e-92c8-aa9d6aa9e9d4","resolution":{"observed_at":"2026-08-03T20:23:54.154679Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:54.290797Z","title":"Text- to-image models for counterfactual explanations: a black- box approach","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:54.290797Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:68bb8d6fc13351d42ab3a0095f3235cdbccfdb7aad1ce12ae502c4380cd3356c","observation_id":"fc65f72c-6e45-411f-83db-ce96345df594","resolution":{"observed_at":"2026-08-03T20:23:54.290797Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:54.464024Z","title":"3d convolu- tional neural networks for human action recognition.IEEE transactions on pattern analysis and machine intelligence, 35(1):221–231, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:54.464024Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:4565e12cd4c64e818885344d7c4b8f7dc95f6f4bb8dc101266d85a49ae3e644a","observation_id":"52db524d-5cd8-4c89-9e8a-8868e6e425d2","resolution":{"observed_at":"2026-08-03T20:23:54.464024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:54.637156Z","title":"Multimodal explanations by predicting coun- terfactuality in videos","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:54.637156Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:2fa00527df6b39d0e309c364ae2a1a07945390eba9247adcf24b642b9276df4e","observation_id":"6763b6b9-5130-4cc5-84b9-57a7c4657019","resolution":{"observed_at":"2026-08-03T20:23:54.637156Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:54.863372Z","title":"Text2video-zero: Text- to-image diffusion models are zero-shot video generators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:54.863372Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:95f8edf32a9dbf619935eb77cab66d5ebb0de88e822b52cfcad9e7ebb1c16fd6","observation_id":"fef03f22-978f-4216-b01f-e3074ff3b96b","resolution":{"observed_at":"2026-08-03T20:23:54.863372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:54.970850Z","title":"Cycle-consistent counter- factuals by latent transformations","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:54.970850Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:449b25cf2d47f790ced005faa21fc64426fced994c005d6cab821dbe3664dc83","observation_id":"bb173821-66f4-4efd-9f1a-b77e4656bd25","resolution":{"observed_at":"2026-08-03T20:23:54.970850Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.11011","last_updated":"2024-05-23T16:59:29Z","snapshot_observed_at":"2026-08-08T22:36:46.225550Z","submitted_at":"2023-10-17T05:45:32Z","title":"From Identifiable Causal Representations to Controllable Counterfactual Generation: A Survey on Causal Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.11011","snapshot_observed_at":"2026-08-03T20:23:55.124342Z","title":"From identifiable causal representations to control- lable counterfactual generation: A survey on causal genera- tive modeling.arXiv preprint arXiv:2310.11011, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:55.124342Z"},"links":{"cited_paper":"/paper/2310.11011","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:83d0a4a81bd8780ec59cf0537054a180c9a19758562c9ce1cfad44e5ebf46c35","observation_id":"0ea10254-07b5-46c2-ba8d-2c53f061536c","resolution":{"observed_at":"2026-08-03T20:23:55.124342Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-08-03T20:23:55.200351Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603, 2024","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:55.200351Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:1fc47cabe96255b42615a29dd4dda9d63523f3b593a88c7a014966fa501a551e","observation_id":"79ca9d28-9f9c-48b2-b3d3-ea0458dc9a7c","resolution":{"observed_at":"2026-08-03T20:23:55.200351Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:55.362376Z","title":"Imagenet classification with deep convolutional neural net- works.Advances in neural information processing systems, 25, 2012","venue":null,"work_id":null,"year":2012},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:55.362376Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:6735e1da365a45e34c7f1c0ad28699df49e45bd9b5ea7c0b5c479f6e5c5e3bdd","observation_id":"f8b84a25-81c2-4e12-85ad-8bf2045ea2a9","resolution":{"observed_at":"2026-08-03T20:23:55.362376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:55.491479Z","title":"On space-time interest points.International journal of computer vision, 64(2):107–123, 2005","venue":null,"work_id":null,"year":2005},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:55.491479Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:309a467f51d79a960202b656ec8e3dcc8d4e497bd236f83e4a88055ed098bda9","observation_id":"73579608-f47c-441e-98d8-1f6a582302e6","resolution":{"observed_at":"2026-08-03T20:23:55.491479Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-08-03T20:23:55.661009Z","title":"Flow matching for generative mod- eling.arXiv preprint arXiv:2210.02747, 2022","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:55.661009Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:86aa69ec0be9515dc0d8410167128fa2bc061f1d4e4d05553aabee0bf1bc0654","observation_id":"0727d717-9ffe-4618-aaf0-031704c60d2c","resolution":{"observed_at":"2026-08-03T20:23:55.661009Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:55.827662Z","title":"Structure matters: Tackling the semantic discrepancy in diffusion models for image inpainting","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:55.827662Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:ade3f7c08d5f23184f338bbd783715687ac7cb94ae4fd16b60395129e3cb2628","observation_id":"0645f9b1-df3d-4332-a5b9-7c8b1bb30f1d","resolution":{"observed_at":"2026-08-03T20:23:55.827662Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:55.982905Z","title":"Video swin transformer","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:55.982905Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:b61e96ad93b9aabb748ec21fcdf9db887c14989bcc6eb314cb1794d0b3058938","observation_id":"e483062d-fed8-4bae-b632-90226fb03a6d","resolution":{"observed_at":"2026-08-03T20:23:55.982905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:56.104033Z","title":"Zero-shot model diagnosis","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:56.104033Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:7b7f0c4a3b3c4be4b25fec4716e1872b7dfd2871e353c2af92e3366a0e10f8d8","observation_id":"03e9f3ee-866c-4555-9840-e0c3a67dbad9","resolution":{"observed_at":"2026-08-03T20:23:56.104033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1706.06083","last_updated":"2019-09-04T18:53:10Z","snapshot_observed_at":"2026-08-07T14:27:46.872660Z","submitted_at":"2017-06-19T17:53:11Z","title":"Towards Deep Learning Models Resistant to Adversarial Attacks","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1706.06083","snapshot_observed_at":"2026-08-03T20:23:56.300892Z","title":"Towards deep learn- ing models resistant to adversarial attacks.arXiv preprint arXiv:1706.06083, 2017","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:56.300892Z"},"links":{"cited_paper":"/paper/1706.06083","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:5206c2b32b9c2d483cde74081653aa756ca8c8796b8a898a0c48b5ac938b3427","observation_id":"bd209c38-15cd-4a2b-920c-fe81b2eb9e95","resolution":{"observed_at":"2026-08-03T20:23:56.300892Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:56.524601Z","title":"Understanding the latent space of diffusion models through the lens of riemannian geometry","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:56.524601Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:04ee6a1377441df63fabea620e748319f587797a6e0d33e6ce5e1f8a854f16d4","observation_id":"0b060fcd-8206-470a-a1fc-b53bae641f3b","resolution":{"observed_at":"2026-08-03T20:23:56.524601Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:56.727630Z","title":"Scalable diffusion models with transformers","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:56.727630Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:cd5e6e802eae9a0e7f5e830d67945f52c61a9909d9b7cfbc1d5ccddc26eaef84","observation_id":"da7ffa31-84bd-48ba-9458-1f366990a577","resolution":{"observed_at":"2026-08-03T20:23:56.727630Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:56.894229Z","title":"Learning transferable visual models from natural language supervi- sion","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:56.894229Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:850271863e42cc3ca6fb993fa51b7ede4f72aab228b1cd02a0772d9c4deaf242","observation_id":"4063d03f-7684-4854-b00a-25387ac83264","resolution":{"observed_at":"2026-08-03T20:23:56.894229Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.012297Z","title":"D’artagnan: Counterfactual video genera- tion","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.012297Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:bc02c8f036d01266184205f86ed74aaf79a8b192459748d3b77a05c49e049d41","observation_id":"d92652d5-4cd6-45d4-a6a4-36bc74504023","resolution":{"observed_at":"2026-08-03T20:23:57.012297Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.164579Z","title":"Beyond trivial counterfactual explanations with diverse valuable explanations","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.164579Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:4fb22e12312df62b2337c47f84ff6124b372889e71ccff952556d1b55bffb2ee","observation_id":"f442e00b-31be-46f0-ba18-0a8043ceeaa8","resolution":{"observed_at":"2026-08-03T20:23:57.164579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.236264Z","title":"High-resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.236264Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:ae3b6eafa9aa1fcd63049c7c65a337bd836d3fd51281402e360db401943b0582","observation_id":"8a78a2c9-0e01-4887-9cef-4200842a912f","resolution":{"observed_at":"2026-08-03T20:23:57.236264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.389014Z","title":"Image synthesis with a single (robust) classifier.Advances in Neu- ral Information Processing Systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.389014Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:e044a90dc3fa386e1797da61b2ffa307cdddfc6eeade682401ac55fa6d632e17","observation_id":"91e28110-b7da-48db-b266-82409384e511","resolution":{"observed_at":"2026-08-03T20:23:57.389014Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.531801Z","title":"Latent Diffusion Counterfactual Explanations.Springer, 15297 LNCS:295–311, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.531801Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:0371275269d5910fcff40946fc9dcbc0c33e5e7984e96bd677498082c9d0f345","observation_id":"ad5348d3-3416-487b-9642-571c52e12be0","resolution":{"observed_at":"2026-08-03T20:23:57.531801Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.782648Z","title":"Ntu rgb+ d: A large scale dataset for 3d human activity anal- ysis","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.782648Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:4bc1a256a00505a9294f0a290509f757075740b105069af040191c7db1157a57","observation_id":"8389afb7-3d2e-4262-a59a-9dceaa4ac012","resolution":{"observed_at":"2026-08-03T20:23:57.782648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.892913Z","title":"Re- thinking visual counterfactual explanations through region constraint","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.892913Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:0c7ec92453d668cd2f69540eb914c7e48ffbdf96aa5c6b0005d150436d5913d1","observation_id":"16c64e02-1b08-4646-9699-1a41d956dd03","resolution":{"observed_at":"2026-08-03T20:23:57.892913Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-03T20:23:57.895910Z","title":"Denoising diffusion implicit models.arXiv preprint arXiv:2010.02502, 2020","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.895910Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:e1cafa3d641e678a32c73d08489f170e0cc2b374c5ca3b946f5f3b6806a390b2","observation_id":"2cf43719-d7aa-492b-b622-d671b0ea92bc","resolution":{"observed_at":"2026-08-03T20:23:57.895910Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.898993Z","title":"Generative modeling by esti- mating gradients of the data distribution.Advances in neural information processing systems, 32, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.898993Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:d655cffa13f3581c9910364cca8c26e79b57b85b1ff9c5440984e4c7b08cb463","observation_id":"0f9a2233-e1b1-46de-ac5f-dd11d203b640","resolution":{"observed_at":"2026-08-03T20:23:57.898993Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.901819Z","title":"Improved techniques for training score-based generative models.Advances in neural information processing systems, 33:12438–12448, 2020","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.901819Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:1f78e7a86b248744ef00f57d43b8ef90791a50e4f17dbd8b38011eae0fb85b54","observation_id":"225016cf-4d8a-4d67-9e44-cbc678eb8891","resolution":{"observed_at":"2026-08-03T20:23:57.901819Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.905353Z","title":"Rethinking the inception archi- tecture for computer vision","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.905353Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:00602349fa7c1117d0c0ff6b6b69ea96522c83a0eecf7fbde3c3ec960a4382d4","observation_id":"ec13bf70-abfa-4f91-af7c-b6f15de5852d","resolution":{"observed_at":"2026-08-03T20:23:57.905353Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-03T20:23:57.908104Z","title":"To- wards accurate generative models of video: A new metric & challenges.arXiv preprint arXiv:1812.01717, 2018","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.908104Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:93b3671b2fd4bd27808630cece2a3fd4d17db63023da7b2828eacb42b590ccbc","observation_id":"d536fc4f-7436-4917-b26a-e447dd532aab","resolution":{"observed_at":"2026-08-03T20:23:57.908104Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.911216Z","title":"Understanding physical dynamics with counterfactual world modeling","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.911216Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:531cee177015c4f54707f72a93dcf2eb489a0d53c68b196a094cf810ead6738d","observation_id":"6d145899-0144-4555-9b1e-ffe0288d6ed9","resolution":{"observed_at":"2026-08-03T20:23:57.911216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.10596","last_updated":"2022-11-15T20:57:53Z","snapshot_observed_at":"2026-07-06T10:06:25.277680Z","submitted_at":"2020-10-20T20:08:42Z","title":"Counterfactual Explanations and Algorithmic Recourses for Machine Learning: A Review","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.10596","snapshot_observed_at":"2026-08-03T20:23:57.914248Z","title":"Dickerson, and Keegan E","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.914248Z"},"links":{"cited_paper":"/paper/2010.10596","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:2c14fe40c5347ba5c51128020c45e8fae7364d351d89d2a299dc563938496c97","observation_id":"91ce34d3-73e7-4cbe-ac71-39f31f7773e2","resolution":{"observed_at":"2026-08-03T20:23:57.914248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.917177Z","title":"Coun- terfactual explanations without opening the black box: Au- tomated decisions and the gdpr.Harv","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.917177Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:85f7d03e9bd6cd7baedbfc598d0306ba2603c54d982dca6961ac6270a0a29fd3","observation_id":"5ddb3503-8388-4d12-9cf3-4e715e9234ec","resolution":{"observed_at":"2026-08-03T20:23:57.917177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-08-03T20:23:57.920203Z","title":"Wan: Open and advanced large-scale video generative models.arXiv preprint arXiv:2503.20314, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.920203Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:5570db2d12167f3d6ddee714513ef9e12a8638a10a8c3e98ce9f96c5e4b42d33","observation_id":"12eff20c-fd95-496d-84b4-ea1d64d9a2b5","resolution":{"observed_at":"2026-08-03T20:23:57.920203Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.923881Z","title":"Mead: A large-scale audio-visual dataset for emotional talking-face generation","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.923881Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:997c998812f966aa2f7d3ad8b637161cffd978704d7fdc2a8d06d4d97f764137","observation_id":"a79fe48f-414f-4423-8e28-dd3cc9acd8ea","resolution":{"observed_at":"2026-08-03T20:23:57.923881Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.927369Z","title":"Video- to-video synthesis","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.927369Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:38b001ba3549a44ae433952220ba29897478ac5e408f4079740de8d9d1804655","observation_id":"d63fb565-70d1-449c-900d-8d2f6a4bec26","resolution":{"observed_at":"2026-08-03T20:23:57.927369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.930813Z","title":"Image quality assessment: from error visibility to structural similarity.IEEE transactions on image processing, 13(4):600–612, 2004","venue":null,"work_id":null,"year":2004},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.930813Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:9a628d9932065ae75e8c553b6c0875997d422e81b44a34db15dadcde87124be4","observation_id":"cb897eec-fca5-435c-8c4b-8547bdb78b6c","resolution":{"observed_at":"2026-08-03T20:23:57.930813Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.933872Z","title":"Fast diffusion-based counterfactuals for shortcut removal and generation","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.933872Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:e3fcba034f7f4039bfd68e174d8c6e5f03418a3abc756ac1685dc6db2bd30533","observation_id":"ee9ee3d2-8df5-4bc4-b279-cbcb565c519a","resolution":{"observed_at":"2026-08-03T20:23:57.933872Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.937177Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.937177Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:56f8a70118c2520e5073bf5abaa5ee1a3b8beb80531b51e07fd805dab147d669","observation_id":"13f24a9e-cc9e-4caa-b97b-35c0284aec5d","resolution":{"observed_at":"2026-08-03T20:23:57.937177Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.940646Z","title":"Celebv-text: A large-scale facial text-video dataset","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.940646Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:042b162ee7b078519deb6c7a05431e5ce12ac638b7fb6a34baf10a46037823df","observation_id":"038f7d07-a8f2-4937-a558-0362e75da6f9","resolution":{"observed_at":"2026-08-03T20:23:57.940646Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T20:23:57.944190Z","title":"The unreasonable effectiveness of deep features as a perceptual metric","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-03T20:23:57.944190Z"},"links":{"citing_paper":"/paper/2511.20295"},"observation_digest":"sha256:1bc6db37d027f8d64bb787d5decc46993380e820882bdae1f345f0a9889c75c1","observation_id":"a12fd937-21e0-44cc-ac76-a13a643b8ce5","resolution":{"observed_at":"2026-08-03T20:23:57.944190Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2511.20295","last_updated":"2026-05-31T10:05:38Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-07T13:00:48.569884Z","submitted_at":"2025-11-25T13:31:30Z","title":"Back to the Feature: Explaining Video Classifiers with Video Counterfactual Explanations"},"reference_resolution":{"displayed":63,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":63,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":63},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 63 of 63 outbound references and 0 inbound Pith citation observations for arXiv:2511.20295."}