{"as_of":"2026-08-06T17:05:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:544c8d8c6562d8baf7f16eba56d3403e36128a647a54bcffe551d3fbb6c7b502","coverage":[{"denominator":30,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":30,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T19:27:33.716719Z","state":"measured"},{"denominator":31,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":31,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T08:24:41.925800Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-05-10T09:08:26.344990Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"cited_work":{"arxiv_id":"2604.05898","doi":null,"metadata_source":"pith","pith_arxiv_id":"2604.05898","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Physics-Aware Video Instance Removal Benchmark","venue":"cs.CV","work_id":"02103417-5670-43be-80f2-3cbfc4e3023a","year":2026},"citing_paper":{"arxiv_id":"2604.16272","last_updated":"2026-04-20T15:50:04Z","snapshot_observed_at":"2026-07-06T23:03:39.351412Z","submitted_at":"2026-04-17T17:28:24Z","title":"VEFX-Bench: A Holistic Benchmark for Generic Video Editing and Visual Effects","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T08:24:41.925800Z"},"links":{"cited_paper":"/paper/2604.05898","citing_paper":"/paper/2604.16272"},"observation_digest":"sha256:2c92869de6f59c3eb8a13ccb6c5b7d360df28bafcca950d7b15aa45f1934cbcd","observation_id":"69e213e2-e1f4-4346-81b7-1b91c1c01508","resolution":{"observed_at":"2026-05-10T09:08:26.347199Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2604.05898/citation-record","integrity":"/paper/2604.05898/integrity","json":"/paper/2604.05898/citation-record.json","paper":"/paper/2604.05898"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.11647","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T21:16:14.748179Z","title":"Ivebench: Modern benchmark suite for instruction-guided video editing assessment","venue":null,"work_id":"0b16c73f-af59-410f-860e-ba21c3eb31cf","year":2025},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:b95334f6ded6b41be958ab55036eaf6135a958a2408ff8fab48ff2a7f04e8ff1","observation_id":"a07a2352-3efb-435a-a74a-688b8f059416","resolution":{"observed_at":"2026-05-10T22:55:52.007690Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fgvc: Flow-guided video completion","venue":null,"work_id":"a39ff81b-dfc3-4f1a-b8d5-1cb11f098b80","year":2019},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:a3a47ed4a5553988d27418f6b611e06b324991ba9add86af9bebf0b38d132c1d","observation_id":"62030e58-ecf4-458e-b2c9-3a72a5a4e358","resolution":{"observed_at":"2026-05-16T05:00:38.386842Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.08277","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T21:56:16.334046Z","title":"Pisco: Precise video instance insertion with sparse control","venue":null,"work_id":"b0a57fb4-6d4c-4bcc-9fe6-21892916cceb","year":2026},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:52b874d4a09955c2ff9c551c2d5e5d10be88d02193af1add06ab4a40a9bc6889","observation_id":"6eb8f29c-60bf-4b26-9392-4a4f7eb0e73a","resolution":{"observed_at":"2026-05-10T22:55:52.036128Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2603.14375","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-09T03:05:55.272428Z","title":"The pulse of motion: Measuring physical frame rate from visual dynamics","venue":null,"work_id":"9bdc4b07-d0bc-40ce-afb8-93bf879bbdc9","year":2026},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:fe3fc4f1f5c6c2d517ba8c017dfac861bad515d353d478eb09db9fb9c11d9d38","observation_id":"54da3375-757e-406c-a12d-5b08ef03e737","resolution":{"observed_at":"2026-05-10T22:55:52.053885Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.10373","last_updated":"2023-11-20T10:54:09Z","snapshot_observed_at":"2026-08-06T08:12:35.134201Z","submitted_at":"2023-07-19T18:00:03Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","version":3},"cited_work":{"arxiv_id":"2307.10373","doi":"10.1109/iccv51701.2025.005","metadata_source":"pith","pith_arxiv_id":"2307.10373","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"TokenFlow: Consistent Diffusion Features for Consistent Video Editing","venue":"cs.CV","work_id":"2e967b53-6386-4564-b468-ffd540817064","year":2023},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/2307.10373","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:f147f34d82b664f7ee594cae2e06498719ae3b9f6bdb12d4105376d94575e6f1","observation_id":"7e7ae1cc-51c4-41fe-98c2-8652d16075a9","resolution":{"observed_at":"2026-05-17T20:17:47.115702Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilib- rium","venue":null,"work_id":"726243f5-8992-447a-8d2f-aee88f46792d","year":2017},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:fbc78bdd40869a2dd14020e2604278a921bdac8ff6f780bb7b4e7da6da4dc585","observation_id":"8012100e-d335-417c-aec9-0dd1accdf8ab","resolution":{"observed_at":"2026-05-16T05:00:38.359475Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2204.03458","last_updated":"2022-06-22T20:22:29Z","snapshot_observed_at":"2026-07-06T12:57:51.108636Z","submitted_at":"2022-04-07T14:08:02Z","title":"Video Diffusion Models","version":2},"cited_work":{"arxiv_id":"2204.03458","doi":"10.48550/arxiv.2204.03458","metadata_source":"pith","pith_arxiv_id":"2204.03458","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Video Diffusion Models","venue":"cs.CV","work_id":"02e03469-549e-4b5a-9bf0-ac6617a89882","year":2022},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/2204.03458","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:e293b7d036d6b1d06bed80e54288825b46211a57ebf69a841fbbdc0bb95612b0","observation_id":"5a011289-7841-443d-923c-f39db9b110b7","resolution":{"observed_at":"2026-05-13T14:38:28.190773Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Vbench++: Comprehensive and versatile benchmark for video understanding and generation","venue":null,"work_id":"ac22546f-d8be-4f2d-a3b4-db289e55c6d1","year":2024},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:80c6e7de9faf17fd2f955ddfdcbbff521f360700a9988d045d80e28ea8fd8dac","observation_id":"f352211b-7e2e-4fcd-889b-fa20ed26996a","resolution":{"observed_at":"2026-05-16T05:00:38.362465Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2503.07598","last_updated":"2025-03-11T06:44:25Z","snapshot_observed_at":"2026-07-06T20:50:05.070886Z","submitted_at":"2025-03-10T17:57:04Z","title":"VACE: All-in-One Video Creation and Editing","version":2},"cited_work":{"arxiv_id":"2503.07598","doi":"10.48550/arxiv.2503.07598","metadata_source":"pith","pith_arxiv_id":"2503.07598","snapshot_observed_at":"2026-07-10T12:15:01.137692Z","title":"VACE: All-in-One Video Creation and Editing","venue":"cs.CV","work_id":"c68efbde-3431-4655-a337-87e2871ad6a3","year":2025},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/2503.07598","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:9369668e7fc85273f5875adb25f125a00907d1885c159b29920996ba10321b50","observation_id":"49818ca0-0a24-4ddc-a18f-5d2a73a356dc","resolution":{"observed_at":"2026-05-16T00:53:54.408026Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:14.2036+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:14.2036+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Segment any- thing","venue":null,"work_id":"cb1b4726-cd0c-4484-af37-2f399f17a3f6","year":2023},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:e29ca612e17ef45ab699e96689f9d2e133098f5c220bca4dc4d7d367cc5d2bfa","observation_id":"b3ca69ec-79fe-477a-86c1-196b50f54744","resolution":{"observed_at":"2026-05-16T05:00:38.365023Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.04761","last_updated":"2023-03-08T17:53:49Z","snapshot_observed_at":"2026-08-06T03:11:45.874095Z","submitted_at":"2023-03-08T17:53:49Z","title":"Video-P2P: Video Editing with Cross-attention Control","version":1},"cited_work":{"arxiv_id":"2303.04761","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2303.04761","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Video-p2p: Video editing with cross- attention control","venue":null,"work_id":"992fb0d5-f233-4443-97a9-806ea0165cc0","year":2023},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/2303.04761","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:48701354f9d5b82016536548efad76a18196e5a8403f893ad47ba0d978545d4c","observation_id":"7889899e-2ff5-42f7-aa71-d3fb15b7034c","resolution":{"observed_at":"2026-05-10T22:55:52.044352Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2501.10018","last_updated":"2025-01-17T08:03:02Z","snapshot_observed_at":"2026-08-06T16:39:48.582832Z","submitted_at":"2025-01-17T08:03:02Z","title":"DiffuEraser: A Diffusion Model for Video Inpainting","version":1},"cited_work":{"arxiv_id":"2501.10018","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2501.10018","snapshot_observed_at":"2026-07-01T21:56:16.292788Z","title":"Diffueraser: A diffusion model for video inpainting","venue":null,"work_id":"da6ed59a-1887-4660-9404-d89f2ab8ca7c","year":2025},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/2501.10018","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:c71b0ed016551cbe2eb3da6423e20a3d9a28f3e942790dd47db55ef8b93f73be","observation_id":"40fe5105-2590-4d39-8f45-e63a1080c8da","resolution":{"observed_at":"2026-05-10T22:55:51.969088Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Towards an end-to-end framework for flow- guided video inpainting","venue":null,"work_id":"376ec07e-9d10-43a9-bcc8-fce5ef3cc09e","year":2022},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:1e6896abd8fa09d7175a3ace629d651d8129fe6a43ffa7367306569a43b990e7","observation_id":"32a7d431-a3a2-4aed-af5e-3ac533f6060e","resolution":{"observed_at":"2026-05-16T05:00:38.383940Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Fuseformer: Fusing fine-grained information in transformers for video inpainting","venue":null,"work_id":"fe9bcf3f-b10c-4c69-97e2-b72d5d6aaed0","year":2021},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:f76084ad93f2b267ebe722ed1268e292158eeb6e94c14bc952f4eb099fedd8f0","observation_id":"35a0939b-2cb1-4799-b81f-1acf0c2c923b","resolution":{"observed_at":"2026-05-16T05:00:38.392949Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2508.18633","last_updated":"2025-08-26T03:18:31Z","snapshot_observed_at":"2026-08-05T16:23:35.382635Z","submitted_at":"2025-08-26T03:18:31Z","title":"ROSE: Remove Objects with Side Effects in Videos","version":1},"cited_work":{"arxiv_id":"2508.18633","doi":"10.48550/arxiv.2508.18633","metadata_source":"arxiv_reference","pith_arxiv_id":"2508.18633","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"CoRR , volume =","venue":"arXiv (Cornell University)","work_id":"549fae3c-8f00-4e04-9010-3fa650524f61","year":2025},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/2508.18633","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:21265986913c096bbee4ac45a76ab6f1133257785f44c2faf5d6a50dfc9e0d25","observation_id":"a9e5343c-f6ea-4f75-b23c-0423f0a9009a","resolution":{"observed_at":"2026-05-10T22:55:51.979192Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-25T00:53:16.265913+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-25T00:53:16.265913+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2604.02296","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T03:59:33.597082Z","title":"V oid: Video object and interaction deletion","venue":null,"work_id":"a74988fa-a657-4c72-a5f6-2c9e12bc5235","year":2026},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:d754f2efc03f936e4ba53c0da78f4a4406283b00793bc5aa8370979fa8b97dca","observation_id":"9c6ab48c-32f8-4810-a8ed-ed2dea940d02","resolution":{"observed_at":"2026-05-10T22:55:51.996946Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":null,"venue":null,"work_id":"b18af1e3-fa91-4264-8d98-801431a9f2d4","year":2016},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:7d73d0bd7669048e1f10291a17b964136fca2e031f4c625c7bbf672b63ec6465","observation_id":"2fa21cd6-973d-40b4-b0cf-4ca642a94e88","resolution":{"observed_at":"2026-05-16T05:00:38.396352Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A benchmark dataset and evaluation methodology for video object segmentation","venue":null,"work_id":"e91290d1-3a35-4274-b8d8-7ec1b08ad89e","year":null},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:bcdc1cebc37d37533fc0e510a8e1df3013e0a6428ecd4e06592ec9495b4df7f9","observation_id":"cd6dac66-f8fc-486f-ac7a-0e8dd293d523","resolution":{"observed_at":"2026-05-16T05:00:38.400081Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"A benchmark dataset and evaluation methodology for video object segmentation","venue":null,"work_id":"ac735805-7d52-435f-b3fd-a7b9f9016121","year":2016},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:6c58bd1f5396e4ed34c2fd66a0899d2a9672c5792526a9b5bed943de6aef6366","observation_id":"8223eb05-da8e-4408-ad02-33ad61c316a4","resolution":{"observed_at":"2026-05-16T05:00:38.402758Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"High-resolution image syn- thesis with latent diffusion models","venue":null,"work_id":"97d1a9e3-1533-413c-b062-b59400505179","year":2022},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:16c70d26d4d60076662b40f747c4e73fc863e8a7cb3b51db16d6c5bbf3b94416","observation_id":"933117de-7b44-46cb-be66-711e6bc9d1c4","resolution":{"observed_at":"2026-05-16T05:00:38.390085Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Adapool: Expo- nential adaptive pooling for information-retaining downsam- pling","venue":null,"work_id":"de9bfdbd-2db5-4e1c-a7b5-5cb61937a6c1","year":2021},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:9e09cbd62fe7cd4e91ac755927a8b2c060a95baa18656d387ca6ac806e6a2d03","observation_id":"a039babf-d0a8-4c06-a436-a327c7a7845e","resolution":{"observed_at":"2026-05-16T05:00:38.377925Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Resolution-robust large mask inpaint- ing with fourier convolutions","venue":null,"work_id":"5091da26-3c6c-4e6e-8af8-ff7ded88a4cc","year":2022},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:8fee9f70ab0beffa71ecff30c57d9f8416c3816bd298feb2bd2e86ce72833b68","observation_id":"995ccb6d-c557-432b-b0e0-7e9bb9418f81","resolution":{"observed_at":"2026-05-16T05:00:38.356629Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1812.01717","last_updated":"2019-03-27T16:43:17Z","snapshot_observed_at":"2026-07-06T07:19:11.957225Z","submitted_at":"2018-12-03T03:57:42Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","version":2},"cited_work":{"arxiv_id":"1812.01717","doi":"10.48550/arxiv.1812.01717","metadata_source":"pith","pith_arxiv_id":"1812.01717","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Towards Accurate Generative Models of Video: A New Metric & Challenges","venue":"cs.CV","work_id":"72f42543-17d5-49aa-ba5a-25d67ffbb88a","year":2018},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/1812.01717","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:5ab5cd383e0b4d475b7e6f48a59628535841c44dda00f5ec7a86929b2902bd1e","observation_id":"c6ca78f0-5a96-408f-bd6c-9082334c9e87","resolution":{"observed_at":"2026-05-11T07:21:21.605786Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.17982","last_updated":"2023-11-29T18:39:01Z","snapshot_observed_at":"2026-07-06T16:54:37.940527Z","submitted_at":"2023-11-29T18:39:01Z","title":"VBench: Comprehensive Benchmark Suite for Video Generative Models","version":1},"cited_work":{"arxiv_id":"2311.17982","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2311.17982","snapshot_observed_at":"2026-07-04T16:29:56.629606Z","title":"Huang et al","venue":null,"work_id":"226f1a8c-964a-43d7-a56c-2b8f3a87d158","year":2023},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/2311.17982","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:f4e83b468ce652cb8e967ef9f38e92533a1a43510e62fc0c869551839a1a2077","observation_id":"1e54b2de-a5d0-4052-a6a5-e031f45e2e4d","resolution":{"observed_at":"2026-05-10T22:55:52.029383Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.08377","last_updated":"2026-07-03T16:46:11Z","snapshot_observed_at":"2026-08-04T10:49:46.339959Z","submitted_at":"2025-10-09T16:01:30Z","title":"UniVideo: Unified Understanding, Generation, and Editing for Videos","version":4},"cited_work":{"arxiv_id":"2510.08377","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2510.08377","snapshot_observed_at":"2026-07-07T03:17:13.018030Z","title":"Univideo: Unified understanding, generation, and editing for videos","venue":null,"work_id":"c6b943b5-97f1-4afc-bf4e-16761043ecac","year":2025},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/2510.08377","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:bfed6977be6f4c304e2fb699353c0a2355960240b67cdfbd9ee0faa7702664c3","observation_id":"3efc82ee-462b-4a27-9657-cc0fc8864b4a","resolution":{"observed_at":"2026-07-07T03:17:13.018030Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2212.11565","last_updated":"2023-03-17T17:28:04Z","snapshot_observed_at":"2026-08-05T08:46:05.124241Z","submitted_at":"2022-12-22T09:43:36Z","title":"Tune-A-Video: One-Shot Tuning of Image Diffusion Models for Text-to-Video Generation","version":2},"cited_work":{"arxiv_id":"2212.11565","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2212.11565","snapshot_observed_at":"2026-07-02T12:16:56.715496Z","title":"Tune-a-video: One-shot tuning of image diffusion models for text-to-video generation","venue":null,"work_id":"71927ab4-2a47-4921-8939-c0fe6715790b","year":2022},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"cited_paper":"/paper/2212.11565","citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:6715218b0424771d4aa288ff01c8c66a76727f18a8604988b262438e92af4587","observation_id":"b2235b24-3c3f-4fb8-8dee-fb3cd71b8b38","resolution":{"observed_at":"2026-05-10T22:55:52.060467Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Youtube-vos: Sequence-to-sequence video object segmentation","venue":null,"work_id":"8755577d-4835-4348-8cfc-9f01ad032d70","year":null},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:e24c6cd10a4cf2d7eb3dc98050dff477cbceb4f1b56c605a8152fa951c5f89eb","observation_id":"aa888e86-9887-439d-8f22-ddd48eceaba7","resolution":{"observed_at":"2026-05-16T05:00:38.368241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Free-form image inpainting with gated con- volution","venue":null,"work_id":"178930d1-5ed4-43aa-8631-c6edb1078c83","year":2019},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:e7d4daa8b8bdaae42646e7bdf8685d8dd114673430c50781041948f87f0aca92","observation_id":"51021183-2bcd-4ccd-92ee-599f00bdd6c9","resolution":{"observed_at":"2026-05-16T05:00:38.374933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Propainter: Improving propagation and transformer for video inpainting","venue":null,"work_id":"55a5dd5c-7bd4-47ef-89fa-13000dbea3c8","year":2023},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:33564696f88742db91521fbda30856096ff6d4a75dd4717862b996adbdc5df02","observation_id":"ab429f62-d6b0-453b-9e36-334f0a278cce","resolution":{"observed_at":"2026-05-16T05:00:38.372138Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cococo: Improving text-guided video inpaint- ing for better consistency, controllability and compatibility","venue":null,"work_id":"1d058353-da22-4dd0-bb1b-44af8a9f2ec9","year":2025},"citing_paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-05-10T19:27:33.716719Z"},"links":{"citing_paper":"/paper/2604.05898"},"observation_digest":"sha256:d43ebf63a87dccbcf018e467d3553879e59545a41dbd00e51424fa2ee7bf8654","observation_id":"c882efd8-dcc7-45ef-a2d0-c7d67097ab5e","resolution":{"observed_at":"2026-05-16T05:00:38.380991Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2604.05898","last_updated":"2026-04-07T14:02:53Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T22:54:30.567988Z","submitted_at":"2026-04-07T14:02:53Z","title":"Physics-Aware Video Instance Removal Benchmark"},"reference_resolution":{"displayed":30,"state_counts":{"malformed_identifier":0,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":1,"verified_exact":11,"verified_fuzzy":15},"total_outbound_references":30},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 30 of 30 outbound references and 1 inbound Pith citation observation for arXiv:2604.05898."}