{"as_of":"2026-08-09T12:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f022f6b4be3350b58dd7c77b2aeb26fe48ff0ae3f93bee1dd72311dd89c26e41","coverage":[{"denominator":21,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":21,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-05T10:46:07.274448Z","state":"measured"},{"denominator":21,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":21,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2509.03794/citation-record","integrity":"/paper/2509.03794/integrity","json":"/paper/2509.03794/citation-record.json","paper":"/paper/2509.03794"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:09.545103Z","title":"Understanding hallucinations in diffusion models through mode interpolation","venue":null,"work_id":"fe9d32ca-1da5-4d52-8f53-84eef1da9cb5","year":2024},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.117007Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:883ab40da73f70f1ec7bc0e64466a0cb10e56d8a08f68070c862c5b544036aad","observation_id":"3c9db626-7c35-48d8-ad3e-bcc6017f2b96","resolution":{"observed_at":"2026-08-05T10:46:09.604046Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:05.190973Z","title":"Diffusion models in vision: A survey","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.190973Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:2b5abba8808c2440bb36bc7618831816d2e312ec6dfbddddc14525da9390e626","observation_id":"96688a5d-8167-48b3-aa55-af7481fa1fe1","resolution":{"observed_at":"2026-08-05T10:46:05.190973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:05.295549Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.295549Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:0e5e21ff8ef8b7f900b413ae725c5752237da7061addba20a0ea4254fabe7cd2","observation_id":"b046b4b5-a339-4f31-8393-7b1989b79569","resolution":{"observed_at":"2026-08-05T10:46:05.295549Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02664","last_updated":"2025-02-20T06:17:25Z","snapshot_observed_at":"2026-08-05T08:58:57.183527Z","submitted_at":"2023-10-04T09:04:20Z","title":"On Memorization in Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02664","snapshot_observed_at":"2026-08-05T10:46:05.359314Z","title":"On memorization in diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.359314Z"},"links":{"cited_paper":"/paper/2310.02664","citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:e43a0e43b3972951bc2c5dc85640be0e7e34e18e4200927098d253e815eabed7","observation_id":"f38adbd0-a521-4c2c-a06a-79802611e3f2","resolution":{"observed_at":"2026-08-05T10:46:05.359314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:09.405531Z","title":"Smooth diffusion: Crafting smooth latent spaces in dif- fusion models","venue":null,"work_id":"f433809c-c7ec-4926-bee6-dd4b9634f2bd","year":2024},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.457509Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:35d094915e9d6cd96cc5737752b6eeaf3c6bf63f5c2a0b67885aaa276037f2fa","observation_id":"39e7fe0d-f8e7-4d6a-adf7-830f104950f0","resolution":{"observed_at":"2026-08-05T10:46:09.467900Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:09.276017Z","title":"Efficient diffu- sion training via min-snr weighting strategy","venue":null,"work_id":"7148d647-aacf-466d-924c-bab9404ed83a","year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.561456Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:bcc090c1ddd909fda4eb0dc183e14d4a1246c80aa86a36b3592207dbd9cef633","observation_id":"5115d40a-75b2-4bdd-bd03-52f31e641877","resolution":{"observed_at":"2026-08-05T10:46:09.331784Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:05.632768Z","title":"Denoising dif- fusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.632768Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:139f31b2237031c8296bb74323321377fd4cffb3eb995f31820fa9c38908e7bc","observation_id":"b426a6b9-2443-4663-a6b8-bb6618d1ee5c","resolution":{"observed_at":"2026-08-05T10:46:05.632768Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:09.132520Z","title":"All but one: Surgical concept erasing with model preservation in text-to- image diffusion models","venue":null,"work_id":"2ce3fdf6-1c7a-4381-bd4d-5280251e4ca8","year":2024},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.739157Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:10741d8460254af8541077b7563d65f59e3cfbc1a087a6d3d4165fd2e5869834","observation_id":"cade58c7-ce21-4d46-8056-d85f9f51877e","resolution":{"observed_at":"2026-08-05T10:46:09.188597Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:08.967568Z","title":"Video diffusion models","venue":null,"work_id":"f99a8ea1-c839-41ab-8f39-2e5f1f761a6b","year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.836790Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:43b96f6dede2ba2a5a1f421f57dd17d3fe0c248d11d230ef1a2535234d6b61c9","observation_id":"344f2163-2494-44d7-b8e8-f92e0d46d6a6","resolution":{"observed_at":"2026-08-05T10:46:09.068398Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02557","last_updated":"2024-04-12T15:48:47Z","snapshot_observed_at":"2026-08-03T00:41:20.399858Z","submitted_at":"2023-10-04T03:30:32Z","title":"Generalization in diffusion models arises from geometry-adaptive harmonic representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02557","snapshot_observed_at":"2026-08-05T10:46:05.951165Z","title":"Generalization in diffusion models arises from geometry-adaptive harmonic representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:05.951165Z"},"links":{"cited_paper":"/paper/2310.02557","citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:c2015075b49db0ad56c3e9b8014548e62ae1242752466f47e2fd7ff26be77232","observation_id":"77adf2ed-9824-46a3-85f3-b2d507f73100","resolution":{"observed_at":"2026-08-05T10:46:05.951165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:06.025971Z","title":"Elucidating the design space of diffusion-based generative models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.025971Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:9ccd2b6f642c42df2b27ea57511e09451065f8509293f51ecfec97b07f1a762c","observation_id":"035e270a-0d0b-44d7-9cc8-f78e275c987b","resolution":{"observed_at":"2026-08-05T10:46:06.025971Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:06.143052Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.143052Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:6ea26ff0b5c1169f62dd6cf51dcce616bf038b111c26a5ff166cc18cc199109c","observation_id":"388716b6-f0c4-4d97-8c16-f2450f487bb3","resolution":{"observed_at":"2026-08-05T10:46:06.143052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:08.780514Z","title":"Mcvd: Masked conditional video diffusion","venue":null,"work_id":"681714c4-72e5-46ed-bffa-cf296a336795","year":2022},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.213334Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:14f31cef0d19d1d945d337dde83085ce7ca68acb61b02e0cb654fe697c2ded6e","observation_id":"4eda1fc9-8483-4ac7-92c1-5c685df35a00","resolution":{"observed_at":"2026-08-05T10:46:08.859438Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-05T10:46:06.346576Z","title":"Denoising diffusion implicit models","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.346576Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:7cee6fae36b7e4f29f4f43ad56a5deea3bb27391aad180acdefc79d11b99203b","observation_id":"c0798527-0cea-4bfe-ad41-b74d0140ba42","resolution":{"observed_at":"2026-08-05T10:46:06.346576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.09027","last_updated":"2025-07-24T15:55:00Z","snapshot_observed_at":"2026-08-08T15:14:26.502885Z","submitted_at":"2025-06-10T17:53:29Z","title":"Diffuse and Disperse: Image Generation with Representation Regularization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.09027","snapshot_observed_at":"2026-08-05T10:46:06.489257Z","title":"Diffuse and disperse: Im- age generation with representation regularization","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.489257Z"},"links":{"cited_paper":"/paper/2506.09027","citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:c3bf3cf98f20a36555f428789941e0f14e43b5bf408b4d001c33bf0b594ad3d0","observation_id":"d426f7c2-0e0a-4ff9-958f-28d190ccb1cf","resolution":{"observed_at":"2026-08-05T10:46:06.489257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:08.501540Z","title":"Video fusion diffusion for video generation","venue":null,"work_id":"1aa44252-209c-4753-93d8-49b35a097ed3","year":2024},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.653500Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:8cb0fe92d76856cc6bc856773662e1035e5122cb69cf29f14b8fce705c3f1128","observation_id":"1fad4622-0c20-4f05-9a1c-bb396e058cc9","resolution":{"observed_at":"2026-08-05T10:46:08.667649Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:08.219628Z","title":"Versatile diffusion: Text, images and variations all in one diffusion model","venue":null,"work_id":"5a4da0dd-3e8c-48cc-a0e6-94d262b4bdf3","year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.817638Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:bf6fdd4b7a6094c2bb8eb2a5180d1e93ed755157cd762fe2f0018813adb255b6","observation_id":"4b68fafd-bc77-4b32-9a73-2c2998158f17","resolution":{"observed_at":"2026-08-05T10:46:08.340859Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:07.879796Z","title":"Fasterdit: Towards faster diffusion transformers train- ing without architecture modification","venue":null,"work_id":"39d1e0f1-9742-4299-a724-4bf14bac4b01","year":2024},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:06.952940Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:b749eadfee8f79ac37d82c94b5c66ba01f75af6b20301e74e1a4a44cabd9cc57","observation_id":"7e8a1991-e596-4785-b60b-7cb79c6e50c4","resolution":{"observed_at":"2026-08-05T10:46:08.031567Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:07.057693Z","title":"Adding conditional control to text-to-image diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:07.057693Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:3e1312f7b81940dad8defc38af8199ec83741ee6d65dd9a4bef27fffa7d46ff3","observation_id":"1b5cd88d-0dfc-47e5-9cb7-96ca82c32e4b","resolution":{"observed_at":"2026-08-05T10:46:07.057693Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:07.629734Z","title":"Freihand: A dataset for markerless capture of hand pose and shape from single rgb images","venue":null,"work_id":"80ab8bbf-aa7c-469a-9a29-805d584c850c","year":2019},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:07.171252Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:2bc25b82037eaf932cb93a1d7eb8f384480053c78bdf673347cc2d28137f904a","observation_id":"dfad6e03-a986-407f-853b-56c7ff97be25","resolution":{"observed_at":"2026-08-05T10:46:07.767154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T10:46:07.391258Z","title":"Contrastive representation learning for hand shape estima- tion","venue":null,"work_id":"805dcefd-3617-4fa3-879e-41e1e7a63bf1","year":2021},"citing_paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-05T10:46:07.274448Z"},"links":{"citing_paper":"/paper/2509.03794"},"observation_digest":"sha256:5734c7d43a9c6d1f4d42f14d9e3f874064f0efd5a581cc133e3fca0d81e4d585","observation_id":"221a4d76-a561-433f-8908-07dbde9c4ff4","resolution":{"observed_at":"2026-08-05T10:46:07.472351Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2509.03794","last_updated":"2025-09-04T01:04:54Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-08T20:50:31.463093Z","submitted_at":"2025-09-04T01:04:54Z","title":"Fitting Image Diffusion Models on Video Datasets"},"reference_resolution":{"displayed":21,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":10,"verified_exact":0,"verified_fuzzy":11},"total_outbound_references":21},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 21 of 21 outbound references and 0 inbound Pith citation observations for arXiv:2509.03794."}