{"as_of":"2026-08-23T01:28:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:1d7d84bb1a365b8c07cc050db6a3e18aa9855e8c6e0c84ce39ca223064019cd6","coverage":[{"denominator":82,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":82,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:57:52.599683Z","state":"measured"},{"denominator":90,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":90,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-22T06:32:14.747728+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-02T05:17:29.851866Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-10T01:26:43.193228Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"cited_work":{"arxiv_id":"2505.16959","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16959","snapshot_observed_at":"2026-07-10T01:26:43.193228Z","title":"& Wyart, M","venue":"cs.LG","work_id":"3ebe8e2e-e3b3-483d-ba7b-34110445b9ce","year":2025},"citing_paper":{"arxiv_id":"2605.06077","last_updated":"2026-05-07T12:00:10Z","snapshot_observed_at":"2026-08-16T20:10:48.530105Z","submitted_at":"2026-05-07T12:00:10Z","title":"Understanding diffusion models requires rethinking (again) generalization","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-05-08T13:53:59.565702Z"},"links":{"cited_paper":"/paper/2505.16959","citing_paper":"/paper/2605.06077"},"observation_digest":"sha256:ca7397e97281a4be567b63589ac9277fe77e3131c95073a038b6459a0a99102e","observation_id":"4bcdc13a-5bd6-4ba2-b438-d4ad2c18c0b9","resolution":{"observed_at":"2026-05-11T18:46:10.706365Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"cited_work":{"arxiv_id":"2505.16959","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16959","snapshot_observed_at":"2026-07-10T01:26:43.193228Z","title":"& Wyart, M","venue":"cs.LG","work_id":"3ebe8e2e-e3b3-483d-ba7b-34110445b9ce","year":2025},"citing_paper":{"arxiv_id":"2605.06367","last_updated":"2026-05-07T14:44:53Z","snapshot_observed_at":"2026-08-14T03:32:59.868883Z","submitted_at":"2026-05-07T14:44:53Z","title":"The Interplay of Data Structure and Imbalance in the Learning Dynamics of Diffusion Models","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-05-08T05:00:23.008831Z"},"links":{"cited_paper":"/paper/2505.16959","citing_paper":"/paper/2605.06367"},"observation_digest":"sha256:7ca16c9119e1c7a7f72387a1b79e7280461f6e9fd14dc6ab12e1f5e150dc0a97","observation_id":"b9dd1d41-c572-49de-9ec0-2e090cd89f3d","resolution":{"observed_at":"2026-05-11T21:36:14.158422Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"cited_work":{"arxiv_id":"2505.16959","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16959","snapshot_observed_at":"2026-07-10T01:26:43.193228Z","title":"& Wyart, M","venue":"cs.LG","work_id":"3ebe8e2e-e3b3-483d-ba7b-34110445b9ce","year":2025},"citing_paper":{"arxiv_id":"2605.10647","last_updated":"2026-05-11T14:33:47Z","snapshot_observed_at":"2026-08-14T11:17:45.927079Z","submitted_at":"2026-05-11T14:33:47Z","title":"diffGHOST: Diffusion based Generative Hedged Oblivious Synthetic Trajectories","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-05-12T05:22:42.432357Z"},"links":{"cited_paper":"/paper/2505.16959","citing_paper":"/paper/2605.10647"},"observation_digest":"sha256:dfa9d9cfb1f7bc8229a5803c1fedc26e158a36ac7b36bb92159c2a22922553f5","observation_id":"e51dde2c-e2fa-4b21-b3f6-3cdf565b9020","resolution":{"observed_at":"2026-05-12T05:26:25.016565Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"cited_work":{"arxiv_id":"2505.16959","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16959","snapshot_observed_at":"2026-07-10T01:26:43.193228Z","title":"& Wyart, M","venue":"cs.LG","work_id":"3ebe8e2e-e3b3-483d-ba7b-34110445b9ce","year":2025},"citing_paper":{"arxiv_id":"2605.21402","last_updated":"2026-05-20T17:00:37Z","snapshot_observed_at":"2026-08-15T14:34:56.475527Z","submitted_at":"2026-05-20T17:00:37Z","title":"Memorisation, convergence and generalisation in generative models","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-21T03:18:34.227888Z"},"links":{"cited_paper":"/paper/2505.16959","citing_paper":"/paper/2605.21402"},"observation_digest":"sha256:b52b8720f3b1e4969e25a3c6f859d576b3176fa30cef15cdfacdddd692a3188b","observation_id":"e5cb16a9-b59d-4857-bd55-2e28e3f1d0ea","resolution":{"observed_at":"2026-05-21T03:19:28.918657Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"cited_work":{"arxiv_id":"2505.16959","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16959","snapshot_observed_at":"2026-07-10T01:26:43.193228Z","title":"& Wyart, M","venue":"cs.LG","work_id":"3ebe8e2e-e3b3-483d-ba7b-34110445b9ce","year":2025},"citing_paper":{"arxiv_id":"2605.27734","last_updated":"2026-05-26T22:16:42Z","snapshot_observed_at":"2026-08-13T02:13:33.819892Z","submitted_at":"2026-05-26T22:16:42Z","title":"Learn from your own latents and not from tokens: A sample-complexity theory","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-29T18:22:40.908929Z"},"links":{"cited_paper":"/paper/2505.16959","citing_paper":"/paper/2605.27734"},"observation_digest":"sha256:ffcba415c5dc578191598d37b35bb654c9b7616210a9144cab16f021901a7733","observation_id":"e55b23f0-5622-4894-b1c0-ec54182a1a63","resolution":{"observed_at":"2026-06-29T18:23:50.532747Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"cited_work":{"arxiv_id":"2505.16959","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16959","snapshot_observed_at":"2026-07-10T01:26:43.193228Z","title":"& Wyart, M","venue":"cs.LG","work_id":"3ebe8e2e-e3b3-483d-ba7b-34110445b9ce","year":2025},"citing_paper":{"arxiv_id":"2606.09718","last_updated":"2026-06-08T16:44:18Z","snapshot_observed_at":"2026-08-02T14:13:16.205581Z","submitted_at":"2026-06-08T16:44:18Z","title":"Evaluating the Representation Space of Diffusion Models via Self-Supervised Principles","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-06-27T17:38:48.252341Z"},"links":{"cited_paper":"/paper/2505.16959","citing_paper":"/paper/2606.09718"},"observation_digest":"sha256:8d24336619ad9c37f87d1c8499413062b4fdf7b7eb98aeab44e81d240b078593","observation_id":"bea07fdb-122e-47e4-89e4-991e86bb0e80","resolution":{"observed_at":"2026-07-02T23:57:28.816683Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"cited_work":{"arxiv_id":"2505.16959","doi":null,"metadata_source":"pith","pith_arxiv_id":"2505.16959","snapshot_observed_at":"2026-07-10T01:26:43.193228Z","title":"& Wyart, M","venue":"cs.LG","work_id":"3ebe8e2e-e3b3-483d-ba7b-34110445b9ce","year":2025},"citing_paper":{"arxiv_id":"2607.08041","last_updated":"2026-07-09T01:33:11Z","snapshot_observed_at":"2026-08-05T19:52:24.345850Z","submitted_at":"2026-07-09T01:33:11Z","title":"An exact information theory of generalization phase transitions in Bayesian diffusion models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-10T01:25:16.156790Z"},"links":{"cited_paper":"/paper/2505.16959","citing_paper":"/paper/2607.08041"},"observation_digest":"sha256:11c60ee1cd6d72745bd5599bb12b3de28566bc9552a380a1f4af10558421be66","observation_id":"5a8560e2-a5a5-4e30-ab93-668bd1868b47","resolution":{"observed_at":"2026-07-10T01:26:43.194566Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.16959","snapshot_observed_at":"2026-08-02T05:17:29.851866Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.13431","last_updated":"2026-07-15T04:23:22Z","snapshot_observed_at":"2026-08-19T13:31:13.752284Z","submitted_at":"2026-07-15T04:23:22Z","title":"Discrete Diffusion Models: A Unified Framework from Tokenization to Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-02T05:17:29.851866Z"},"links":{"cited_paper":"/paper/2505.16959","citing_paper":"/paper/2607.13431"},"observation_digest":"sha256:2c26ac34f4a3235f5f160ae77744aec75c6ad8a99b45216833e51de27e315e46","observation_id":"65adc0e2-ffa0-43b1-a350-b52440e666f1","resolution":{"observed_at":"2026-08-02T05:17:29.851866Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.16959/citation-record","integrity":"/paper/2505.16959/integrity","json":"/paper/2505.16959/citation-record.json","paper":"/paper/2505.16959"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:45.492270Z","title":"Deep unsuper- vised learning using nonequilibrium thermodynamics","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:45.492270Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:767bd1b0da21ffc6b9e9e054ac1e5ec9535d33da94e9285da565f253600f3d75","observation_id":"e19b08ad-cab9-46f6-80b1-a255dc5c296d","resolution":{"observed_at":"2026-08-07T14:57:45.492270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:45.582368Z","title":"Denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:45.582368Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:764cbfa0609e5b7c420431ec1ea45629e167e0a7b8b1356b9096e02db0be7528","observation_id":"73c416c0-ae2c-4dad-8098-10bc5164408d","resolution":{"observed_at":"2026-08-07T14:57:45.582368Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:45.702056Z","title":"Diffusion models beat gans on image synthesis","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:45.702056Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:4d99be29b6e51434ad7706e0bcea72ed326d69186ad36f237b512fed63f0e290","observation_id":"3c53bce8-001b-4e59-b441-d3820b0a998b","resolution":{"observed_at":"2026-08-07T14:57:45.702056Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:45.780314Z","title":"High- resolution image synthesis with latent diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:45.780314Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:c6abcd1514362abcd85f814256039a8830fda361c7c63d2bb5d29fd592c3d6cb","observation_id":"e363bf8b-c22e-492a-b513-40c732fdd0f4","resolution":{"observed_at":"2026-08-07T14:57:45.780314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2204.06125","last_updated":"2022-04-13T01:10:33Z","snapshot_observed_at":"2026-08-15T12:50:58.405488Z","submitted_at":"2022-04-13T01:10:33Z","title":"Hierarchical Text-Conditional Image Generation with CLIP Latents","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2204.06125","snapshot_observed_at":"2026-08-07T14:57:45.852231Z","title":"Hierarchical text-conditional image generation with clip latents","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:45.852231Z"},"links":{"cited_paper":"/paper/2204.06125","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:b927446dbd44ef86b67c39804ba73c0128b00f00a3e47146d6b1f71c687d7087","observation_id":"b0d05fe7-e22a-4ad2-822c-613b23f4f685","resolution":{"observed_at":"2026-08-07T14:57:45.852231Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:45.973836Z","title":"Video diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:45.973836Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:504a0be29378d15221cae2246349cc9ea980516bdf93f66ae348459d3d03e2c5","observation_id":"8132bc21-a54d-48fa-be57-9f2870e3fd40","resolution":{"observed_at":"2026-08-07T14:57:45.973836Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.15127","last_updated":"2023-11-25T22:28:38Z","snapshot_observed_at":"2026-08-20T09:39:07.545813Z","submitted_at":"2023-11-25T22:28:38Z","title":"Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.15127","snapshot_observed_at":"2026-08-07T14:57:46.068628Z","title":"Stable video diffusion: Scaling latent video diffusion models to large datasets","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.068628Z"},"links":{"cited_paper":"/paper/2311.15127","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:4eb4e59c267a082a225dcdb47246c1f3d29214368f62e70d78ad7cf9c3a1a38e","observation_id":"08de7fa9-7549-45b9-ab5b-35260468a037","resolution":{"observed_at":"2026-08-07T14:57:46.068628Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:46.133981Z","title":"Structured denoising diffusion models in discrete state-spaces","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.133981Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:d706e993a2d1fc03f16fd907a96400a43478e0f5eee894b975a0900bdd45da5c","observation_id":"b7e75112-314d-47bb-bbe5-b2edbe20757f","resolution":{"observed_at":"2026-08-07T14:57:46.133981Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.07524","last_updated":"2024-11-10T20:34:34Z","snapshot_observed_at":"2026-08-18T11:30:56.545811Z","submitted_at":"2024-06-11T17:51:40Z","title":"Simple and Effective Masked Diffusion Language Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.07524","snapshot_observed_at":"2026-08-07T14:57:46.202783Z","title":"Simple and effective masked diffusion language models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.202783Z"},"links":{"cited_paper":"/paper/2406.07524","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:e7e29fac5ebfb63db33b71e4977751a35e57bf7582dfea0545c2b827c36974da","observation_id":"bf2025af-1ef3-46cb-b491-caf6e9cafd3b","resolution":{"observed_at":"2026-08-07T14:57:46.202783Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.04329","last_updated":"2025-01-16T08:46:16Z","snapshot_observed_at":"2026-08-16T13:45:24.595884Z","submitted_at":"2024-06-06T17:59:10Z","title":"Simplified and Generalized Masked Diffusion for Discrete Data","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.04329","snapshot_observed_at":"2026-08-07T14:57:46.318072Z","title":"Simplified and generalized masked diffusion for discrete data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.318072Z"},"links":{"cited_paper":"/paper/2406.04329","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:fbd3e605d246783c18eb2f495d82ae193fcda553d18530d65e8cfef963e5941c","observation_id":"4695e87e-ae12-4b68-8b9a-6fcfc39cbc80","resolution":{"observed_at":"2026-08-07T14:57:46.318072Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09992","last_updated":"2025-10-18T15:35:05Z","snapshot_observed_at":"2026-08-22T07:09:34.819168Z","submitted_at":"2025-02-14T08:23:51Z","title":"Large Language Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09992","snapshot_observed_at":"2026-08-07T14:57:46.382247Z","title":"Large language diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.382247Z"},"links":{"cited_paper":"/paper/2502.09992","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:1bae6451844db5bd5193c42b701a55abf9bba09b47878716d7715f96759d7afd","observation_id":"6329a6c6-cd30-4b39-8ff1-203f4dcd4b04","resolution":{"observed_at":"2026-08-07T14:57:46.382247Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:46.488041Z","title":"De novo design of protein structure and function with rfdiffusion","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.488041Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:002972596025b7a979bfd6ccd90ba7d383eb555b172453e380700f489aaf902d","observation_id":"006f302f-8629-401d-8507-435677932915","resolution":{"observed_at":"2026-08-07T14:57:46.488041Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:58.274129Z","title":"Diffusion models in de novo drug design","venue":null,"work_id":"3e2e74ee-5065-4b65-b842-72530f144ce4","year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.552609Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:676cae1b9e6782e361995acf8dcd4669de8b5fa9219769f7fa8a16d07e668631","observation_id":"edfc067c-fe10-4b70-9b2a-2933ff09db0b","resolution":{"observed_at":"2026-08-07T14:57:58.317312Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:46.621044Z","title":"Generative modeling by estimating gradients of the data distribution","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.621044Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:0b8df187ffa49e914e4896c5dc274afded698d3b3e03357febe455b90ae2bb84","observation_id":"a0f9db33-4fc5-41ca-8cfd-82062bdcc264","resolution":{"observed_at":"2026-08-07T14:57:46.621044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-07T14:57:46.709529Z","title":"Score-based generative modeling through stochastic differential equations","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.709529Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:2f9325014ccfb2da549f82101e290c88b3bda80b06c9bcb5342bfce2b7c4a740","observation_id":"e53f4c0c-b2f6-488f-818a-cb45794f6a5e","resolution":{"observed_at":"2026-08-07T14:57:46.709529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:46.792896Z","title":"Extracting training data from diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.792896Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:a784452149f10e40a5d20b85ca080adee1be05a03c278b7a0f0641420cfd7b3e","observation_id":"5648dc04-2c0d-4fee-a12d-b6f9badf3bf0","resolution":{"observed_at":"2026-08-07T14:57:46.792896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:58.091150Z","title":"Diffusion art or digital forgery","venue":null,"work_id":"1efd5c11-6613-4ef9-8186-036e13455320","year":2022},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.863441Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:8c5fa11270b298913b25c1e211c41039e327e5113a47b69bb9165001dce80a9c","observation_id":"4690613e-2235-41b5-9473-ce2009a02bd3","resolution":{"observed_at":"2026-08-07T14:57:58.162911Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2210.00968","last_updated":"2022-10-03T14:31:39Z","snapshot_observed_at":"2026-08-16T16:27:19.163298Z","submitted_at":"2022-10-03T14:31:39Z","title":"Membership Inference Attacks Against Text-to-image Generation Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.00968","snapshot_observed_at":"2026-08-07T14:57:46.936499Z","title":"Membership inference attacks against text-to-image generation models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:46.936499Z"},"links":{"cited_paper":"/paper/2210.00968","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:96d83b3b5b9dd812840c43c7867e2fa98985d6f5e3bdc7a61e266c77560f5de1","observation_id":"46bb7601-7410-4dc4-87f5-cabcd3a1c864","resolution":{"observed_at":"2026-08-07T14:57:46.936499Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:57.918785Z","title":"Membership inference attacks against diffusion models","venue":null,"work_id":"8855b20b-2ad0-4dac-a873-b5d19e7e63e3","year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.041124Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:587a9a48824b099e4af06fd4d754ab03dfad69a8957ef7a5abbf39e27bde4254","observation_id":"aaf227b2-0197-41e3-8161-001c7b6eb8e8","resolution":{"observed_at":"2026-08-07T14:57:58.002383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2301.09956","last_updated":"2023-01-24T12:34:27Z","snapshot_observed_at":"2026-08-17T11:19:37.096260Z","submitted_at":"2023-01-24T12:34:27Z","title":"Membership Inference of Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.09956","snapshot_observed_at":"2026-08-07T14:57:47.139997Z","title":"Membership inference of diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.139997Z"},"links":{"cited_paper":"/paper/2301.09956","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:38ac1d9c0ff2c1d55973961041a431a06e56d052f65f033fe437566f87471ea2","observation_id":"d7d1b60c-0b6e-449e-a5d1-edc298ca6f6e","resolution":{"observed_at":"2026-08-07T14:57:47.139997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:57.774103Z","title":"Diffusion probabilistic models generalize when they fail to memorize","venue":null,"work_id":"f1b7af79-833d-4107-bd38-c64b0b815d89","year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.233290Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:4b881adcdd118691ad2e40f5b4f6053bdaa7241eae55b7c6cafde0ab679fe2d4","observation_id":"7bc9009f-39f8-4917-aaca-1bc02c561b85","resolution":{"observed_at":"2026-08-07T14:57:57.825276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05264","last_updated":"2026-06-09T14:55:52Z","snapshot_observed_at":"2026-08-17T11:00:29.277455Z","submitted_at":"2023-10-08T19:02:46Z","title":"The Emergence of Reproducibility and Generalizability in Diffusion Models","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05264","snapshot_observed_at":"2026-08-07T14:57:47.319751Z","title":"The emergence of reproducibility and generalizability in diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.319751Z"},"links":{"cited_paper":"/paper/2310.05264","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:a3d09babf73a2ea0e7af100c41bb8ead8aacf7ec5ed4b736d83f716b8912de77","observation_id":"3acc86ae-797d-42bc-8400-81723506cf7b","resolution":{"observed_at":"2026-08-07T14:57:47.319751Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02557","last_updated":"2024-04-12T15:48:47Z","snapshot_observed_at":"2026-08-21T00:12:00.474038Z","submitted_at":"2023-10-04T03:30:32Z","title":"Generalization in diffusion models arises from geometry-adaptive harmonic representations","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02557","snapshot_observed_at":"2026-08-07T14:57:47.428335Z","title":"Generalization in diffusion models arises from geometry-adaptive harmonic representations","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.428335Z"},"links":{"cited_paper":"/paper/2310.02557","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:5ff2afbf2bea147912ffcc0558ce5cbc8b96dba4555d86bb0e2b34973b70a991","observation_id":"01be6ff5-9c26-4339-a9c1-43326312a9e2","resolution":{"observed_at":"2026-08-07T14:57:47.428335Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:47.504488Z","title":"Improved denoising diffusion probabilistic models","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.504488Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:6b15396b340e75734b124338c9df6421c014d20b7ba15d0bcbf61c780230a1c9","observation_id":"8848cd7a-20a6-4ee6-be27-35ad88305469","resolution":{"observed_at":"2026-08-07T14:57:47.504488Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.12089","last_updated":"2025-06-04T11:03:45Z","snapshot_observed_at":"2026-08-21T10:58:41.346847Z","submitted_at":"2025-02-17T18:06:33Z","title":"How Compositional Generalization and Creativity Improve as Diffusion Models are Trained","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.12089","snapshot_observed_at":"2026-08-07T14:57:47.567314Z","title":"How compositional generalization and creativity improve as diffusion models are trained","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.567314Z"},"links":{"cited_paper":"/paper/2502.12089","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:bc6746999f5baa33237af12785b2265f3b876936ab0c876a338bbfd91728d67c","observation_id":"f0eeea79-e923-4d9e-b99d-4a679af386b4","resolution":{"observed_at":"2026-08-07T14:57:47.567314Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.09929","last_updated":"2023-12-31T01:24:45Z","snapshot_observed_at":"2026-08-16T16:23:09.812885Z","submitted_at":"2022-10-18T15:20:47Z","title":"Differentially Private Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.09929","snapshot_observed_at":"2026-08-07T14:57:47.630695Z","title":"Differentially private diffusion models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.630695Z"},"links":{"cited_paper":"/paper/2210.09929","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:a5ef1f21abb308c6ad7e93fd3d307e3ceebcca80606aa17439c00a009def1d01","observation_id":"e6bd0b7c-a676-41e2-abc2-fcd46db01b55","resolution":{"observed_at":"2026-08-07T14:57:47.630695Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:57.627781Z","title":"On provable copyright protection for generative models","venue":null,"work_id":"be6d4290-08a9-4be1-8c94-e963ab503e0c","year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.709702Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:7c2a030ea36c7ad8ac619504a7ed443b3ab8f1c6f2895b5974233146ffb7c008","observation_id":"531d923e-48ab-4d29-ab7f-9fbee76b50be","resolution":{"observed_at":"2026-08-07T14:57:57.677276Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:47.788022Z","title":"Towards memorization-free diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.788022Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:a35b7f6b1ac3886c741dce085174e6c60eb57c33ef1e8a4845b734b15e7b003e","observation_id":"06b5a7ad-6a5e-45ed-816d-8e57a5fc1f20","resolution":{"observed_at":"2026-08-07T14:57:47.788022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:47.869701Z","title":"Argmax flows and multinomial diffusion: Learning categorical distributions","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.869701Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:3f05b3ee45684845931c74041ad9fb32300a3ae7057bf5d0541186023cb32439","observation_id":"c74d3def-32c3-43d7-999d-7e8821a418c8","resolution":{"observed_at":"2026-08-07T14:57:47.869701Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:47.925268Z","title":"U-net: Convolutional networks for biomedical image segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:47.925268Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:894583147b6a9a3e3c0578cf82c427ddb8d98de9e2c0a14b51ac27531d2e5025","observation_id":"01b5c4d4-e752-4e71-ac6b-666b4fb7e299","resolution":{"observed_at":"2026-08-07T14:57:47.925268Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1701.05517","last_updated":"2017-01-19T17:29:06Z","snapshot_observed_at":"2026-08-15T06:38:10.590597Z","submitted_at":"2017-01-19T17:29:06Z","title":"PixelCNN++: Improving the PixelCNN with Discretized Logistic Mixture Likelihood and Other Modifications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1701.05517","snapshot_observed_at":"2026-08-07T14:57:48.004089Z","title":"Pixelcnn++: Improving the pixelcnn with discretized logistic mixture likelihood and other modifications","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.004089Z"},"links":{"cited_paper":"/paper/1701.05517","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:0332877023d7584cc47da029ec97f778f969798b8a1a6a2f8726325d98b7c1bb","observation_id":"2244f15b-ca62-4975-85a5-eace54af563e","resolution":{"observed_at":"2026-08-07T14:57:48.004089Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:57.439687Z","title":"Attention is All you Need","venue":null,"work_id":"771018b3-01ea-4a9c-b778-8b844a9cba53","year":2017},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.083725Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:a3682a3b8198d2c1b259db7f066211ba851691fed01c5e0c0f2354d004af23e8","observation_id":"4937e92d-13eb-49c2-9e50-8f5d1372d038","resolution":{"observed_at":"2026-08-07T14:57:57.514716Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1712.03298","last_updated":"2017-12-08T22:26:58Z","snapshot_observed_at":"2026-08-16T08:36:46.188174Z","submitted_at":"2017-12-08T22:26:58Z","title":"Neumann Optimizer: A Practical Optimization Algorithm for Deep Neural Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1712.03298","snapshot_observed_at":"2026-08-07T14:57:48.179034Z","title":"Neumann optimizer: A practical optimization algorithm for deep neural networks","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.179034Z"},"links":{"cited_paper":"/paper/1712.03298","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:37c134cc6df329814a9f809d45af50b1dc758c3328fef8d14c2e5c605b8383d6","observation_id":"3f7c7eec-78b2-4236-9f3d-e1b39b9c860a","resolution":{"observed_at":"2026-08-07T14:57:48.179034Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:48.267024Z","title":"Laion- 5b: An open large-scale dataset for training next generation image-text models","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.267024Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:14522ec398524cdff1faae19da8d8fe093c3148a1cc05bd1284f12306fb64bc5","observation_id":"8c5b7a99-7e7a-47fc-809c-e4e0200b5864","resolution":{"observed_at":"2026-08-07T14:57:48.267024Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:57.253320Z","title":"Large-scale celebfaces attributes (celeba) dataset","venue":null,"work_id":"3a07e666-2e67-4123-bb49-d691437d5a3b","year":2018},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.342376Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:0e8224a3adcadac42bbabf33937a35a5244f1dee20f573818f6a57d50051a42c","observation_id":"97a2f70d-f1c6-4a88-b1b5-17eebd81b47e","resolution":{"observed_at":"2026-08-07T14:57:57.343044Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:48.418372Z","title":"Why diffusion models don’t memorize: The role of implicit dynamical regularization in training","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.418372Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:3cd82ef7c300e43d6f6195c09b220c19d069584e2766e69b01f70a2474ec11d8","observation_id":"3b7d8581-0692-4844-b170-84ed8ff1455f","resolution":{"observed_at":"2026-08-07T14:57:48.418372Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:57.069662Z","title":"Neural tangent kernel: Convergence and generalization in neural networks","venue":null,"work_id":"84f7ff5f-77aa-4b92-b838-4fe1c07d9908","year":2018},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.481591Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:abacceb6b75e57bbb965750dd7c6655eac831d06647c4ef3f344a01903408adf","observation_id":"c4fff9ec-0672-4292-94c0-d50274908289","resolution":{"observed_at":"2026-08-07T14:57:57.157172Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:56.820794Z","title":"On lazy training in differentiable program- ming","venue":null,"work_id":"d9695d35-51b7-45c9-b037-baf3c8da5426","year":2019},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.559477Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:b6ef5942906a82ae800057b53aacc4e7b664c0e628f80f9258eb7b471ad36e2e","observation_id":"9e333c4f-f308-4f61-97eb-722b39208468","resolution":{"observed_at":"2026-08-07T14:57:56.944159Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:56.510995Z","title":"Three models for the description of language.IRE Transactions on information theory, 2(3):113–124, 1956","venue":null,"work_id":"c0cfce2b-bf9a-411e-894a-e3d26a671154","year":1956},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.628613Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:a91421047ec0f452a5e377d2c6646742589fe34055c517f0fbc727598c23dca1","observation_id":"b8ca3b32-2988-45ba-85c6-8460520cea00","resolution":{"observed_at":"2026-08-07T14:57:56.614521Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:56.308396Z","title":"Handbook of Formal Languages","venue":null,"work_id":"d466285a-221d-4c41-a18d-a54d852b9a1b","year":1997},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.743196Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:917f236a016b2f88d569d7efee1bd9fdf9bf4a99161ac9632018f4442209909c","observation_id":"1091fa28-0715-4815-a96f-0159b3eaf7e1","resolution":{"observed_at":"2026-08-07T14:57:56.387908Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:56.141923Z","title":"Pullum and Gerald Gazdar","venue":null,"work_id":"31025789-5717-4481-b873-6935e626996f","year":1982},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.853499Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:024ac8cc61088e72a16010d2bfcc0cd1c8daba886ec4a351f4966936852f30c7","observation_id":"dfc66af4-3e3b-4967-9636-018a329d0528","resolution":{"observed_at":"2026-08-07T14:57:56.216601Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:55.963729Z","title":null,"venue":null,"work_id":"2c7219ec-fe13-4429-a9c0-0150d1ac3db7","year":1985},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:48.943980Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:fea6aaf4b3db3bae70164471269266dda4b3cdce65bcdc96af25be4965ee58c5","observation_id":"f2de687b-ccd6-4a8c-b5a6-ddde18d82371","resolution":{"observed_at":"2026-08-07T14:57:56.040683Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:55.785431Z","title":"Manning and Hinrich Schütze","venue":null,"work_id":"4487e441-5af5-48e3-bc64-e4d396c4e248","year":1999},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.034905Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:2745701f1022eb9a47f4b76e966aecb7bb49367cd8585ab13804a06e44497e1d","observation_id":"a87201e3-37f7-409e-8876-85a69503a803","resolution":{"observed_at":"2026-08-07T14:57:55.868965Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:55.577588Z","title":"Elements of pattern theory","venue":null,"work_id":"34fc4bef-5772-46f8-9944-84c595b473f8","year":1996},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.125221Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:979541603cfd57c3f71ba5563c3c4205e6bf74ef65e54a8952fa9fcd9939c1d8","observation_id":"da4c025b-b91c-4f16-a032-3095ba890e93","resolution":{"observed_at":"2026-08-07T14:57:55.693703Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:55.408709Z","title":"Context and hierarchy in a probabilistic image model","venue":null,"work_id":"72250ecf-4a47-4064-9b92-392b32ac45cc","year":2006},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.209645Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:b936a215470e5ce099fba75c9f4833e7bc2bfeb995298e267363e6ee7c651c8e","observation_id":"f1632ca7-c808-4415-bcda-6c01cafed44a","resolution":{"observed_at":"2026-08-07T14:57:55.480627Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:55.236868Z","title":"Spatial random tree grammars for modeling hierarchal structure in images with regions of arbitrary shape","venue":null,"work_id":"0371caca-8a0e-4ddf-8362-222ff813d5c1","year":2007},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.264139Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:1bc894b189f803ad6fce78d18e83a477e133a0b2637faf33c4675077c763fa0a","observation_id":"65ffa34e-6a91-422f-ac87-3d3cfcdc53c1","resolution":{"observed_at":"2026-08-07T14:57:55.330539Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:55.075527Z","title":"Tomasini, Alessandro Favero, and Matthieu Wyart","venue":null,"work_id":"1b4fa998-05de-4e48-a5d5-d2d50581833a","year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.322813Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:1b586ee9ab76f7b8ebd96800e6268745ddf3ecdd1653fac1b1b5dcfd1a32dc29","observation_id":"49a78903-ed49-4903-a826-04e40c674c7e","resolution":{"observed_at":"2026-08-07T14:57:55.148240Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:54.864114Z","title":"Towards a theory of how the structure of language is acquired by deep neural networks","venue":null,"work_id":"3b1400eb-ad7a-4b48-ae1c-2e61ed0a9adc","year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.419678Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:b6270ab20174fc93c617724c9f4eb8e56db194beaa6d227590d242462419e44e","observation_id":"b0cdba0d-2250-4b4b-acab-f53420b59dbb","resolution":{"observed_at":"2026-08-07T14:57:54.973333Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:54.741463Z","title":"Information, physics, and computation","venue":null,"work_id":"141f1c51-4f1e-43cf-9307-d0b2e5c9421c","year":2009},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.488460Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:b5ff7eb19518f174e55040fe4c0fd4571efa0afe790d4366f19366280a58ae37","observation_id":"8fc3ba7b-50c8-47c9-9f84-b2bab5126479","resolution":{"observed_at":"2026-08-07T14:57:54.791241Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16991","last_updated":"2024-12-24T02:17:39Z","snapshot_observed_at":"2026-08-16T14:15:09.565907Z","submitted_at":"2024-02-26T19:52:33Z","title":"A Phase Transition in Diffusion Models Reveals the Hierarchical Nature of Data","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.16991","snapshot_observed_at":"2026-08-07T14:57:49.558865Z","title":"A phase transition in diffusion models reveals the hierarchical nature of data","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.558865Z"},"links":{"cited_paper":"/paper/2402.16991","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:c6823410cafd21e1102fd71e10a9db7d1ba87801d03be742637e91b291558aa7","observation_id":"326e28f5-b2ea-45b0-b033-fd94bb7490ac","resolution":{"observed_at":"2026-08-07T14:57:49.558865Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2410.13770","last_updated":"2025-02-28T20:28:34Z","snapshot_observed_at":"2026-08-18T13:08:11.736281Z","submitted_at":"2024-10-17T17:08:39Z","title":"Probing the Latent Hierarchical Structure of Data via Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2410.13770","snapshot_observed_at":"2026-08-07T14:57:49.606341Z","title":"Probing the latent hierarchical structure of data via diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.606341Z"},"links":{"cited_paper":"/paper/2410.13770","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:30a2d2be12b5d012bd445543493b90b2d60cdc3c837e3138e4bd42136f792071","observation_id":"69625408-7e39-4bf6-a3d7-422e78b35da5","resolution":{"observed_at":"2026-08-07T14:57:49.606341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2011.14522","last_updated":"2022-07-15T17:04:24Z","snapshot_observed_at":"2026-08-20T14:04:40.747807Z","submitted_at":"2020-11-30T03:21:05Z","title":"Feature Learning in Infinite-Width Neural Networks","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2011.14522","snapshot_observed_at":"2026-08-07T14:57:49.676387Z","title":"Feature learning in infinite-width neural networks","venue":null,"work_id":null,"year":2011},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.676387Z"},"links":{"cited_paper":"/paper/2011.14522","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:66154f403353567c4f29773217abd8e2b8c169099cd2424175b3c27f553a79e8","observation_id":"79660be6-9425-4236-a8a7-163a9799a9e6","resolution":{"observed_at":"2026-08-07T14:57:49.676387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.07067","last_updated":"2025-05-11T17:38:40Z","snapshot_observed_at":"2026-08-18T09:47:29.994030Z","submitted_at":"2025-05-11T17:38:40Z","title":"Learning curves theory for hierarchically compositional data with power-law distributed features","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.07067","snapshot_observed_at":"2026-08-07T14:57:49.743234Z","title":"Learning curves theory for hierarchi- cally compositional data with power-law distributed features","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.743234Z"},"links":{"cited_paper":"/paper/2505.07067","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:fc85cc67f0340ab63b53d95a10575a04c0d18918fdf9f93b1704135e24c460b6","observation_id":"996bb69f-a046-4837-84ee-6a7fa91a1359","resolution":{"observed_at":"2026-08-07T14:57:49.743234Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:54.625574Z","title":"Understanding and mitigating copying in diffusion models","venue":null,"work_id":"c3ef719c-1669-4ce7-aa9a-59f875c0c874","year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.802270Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:aa9beed20d2fe237a596ae3659acd2046e2a69af4714e4f73e3878e555f8e39b","observation_id":"9ebe800c-e208-4830-a66b-7b51c953bb9f","resolution":{"observed_at":"2026-08-07T14:57:54.682889Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:54.497727Z","title":"Replica- tion in visual diffusion models: A survey and outlook","venue":null,"work_id":"2186d27a-7b65-40f7-b595-3925323b3500","year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.873229Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:8fc44e35c1808015212978c8e2b03f2dda28bf0b8565d9b54760cf89f56ea1c0","observation_id":"1289c680-3e18-4f91-ad31-5041829fbef4","resolution":{"observed_at":"2026-08-07T14:57:54.556753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:49.941359Z","title":"On memorization in diffusion models","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:49.941359Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:0080bce38fdaf199e72bac9df6fec65b9efdb3d1857c85ec0a582264931dbfcc","observation_id":"21039e3c-5b74-4936-b5d3-2e410b08e9ff","resolution":{"observed_at":"2026-08-07T14:57:49.941359Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:50.047484Z","title":"Understanding generalizability of diffusion models requires rethinking the hidden gaussian structure","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.047484Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:0d4e746119f1ddb5509944328d1acd880d10a96c08d00b0bebafbf512ac001e9","observation_id":"fc1e4cab-b2ea-48a1-9617-1e35b8829f15","resolution":{"observed_at":"2026-08-07T14:57:50.047484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.09726","last_updated":"2024-12-12T21:31:27Z","snapshot_observed_at":"2026-08-18T08:24:05.518382Z","submitted_at":"2024-12-12T21:31:27Z","title":"The Unreasonable Effectiveness of Gaussian Score Approximation for Diffusion Models and its Applications","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.09726","snapshot_observed_at":"2026-08-07T14:57:50.126301Z","title":"The unreasonable effectiveness of gaussian score approximation for diffusion models and its applications","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.126301Z"},"links":{"cited_paper":"/paper/2412.09726","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:7dff4d008b6013e20c318c82488b07e71caba67b65e56b5704099a7979859d4b","observation_id":"e7978e32-0bf2-43a3-906f-c7a4fff13edd","resolution":{"observed_at":"2026-08-07T14:57:50.126301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2002.00107","last_updated":"2022-10-11T17:56:49Z","snapshot_observed_at":"2026-08-20T02:06:28.152931Z","submitted_at":"2020-01-31T23:50:03Z","title":"Generative Modeling with Denoising Auto-Encoders and Langevin Sampling","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2002.00107","snapshot_observed_at":"2026-08-07T14:57:50.211949Z","title":"Generative modeling with denoising auto-encoders and langevin sampling","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.211949Z"},"links":{"cited_paper":"/paper/2002.00107","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:e70b259b239419a25680ee6e7c1fb7d234662be2ef3e7defba27db69534a02af","observation_id":"f173b5cd-ff8f-428a-8f69-6b5867a56b47","resolution":{"observed_at":"2026-08-07T14:57:50.211949Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.01861","last_updated":"2023-03-03T11:31:55Z","snapshot_observed_at":"2026-08-18T15:52:09.296378Z","submitted_at":"2023-03-03T11:31:55Z","title":"Diffusion Models are Minimax Optimal Distribution Estimators","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2303.01861","snapshot_observed_at":"2026-08-07T14:57:50.315240Z","title":"Diffusion models are minimax optimal distribution estimators","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.315240Z"},"links":{"cited_paper":"/paper/2303.01861","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:8c885b498e4f3d48ea699fdfe141034a90a8ecba225132dd249c2327ac0b7d3e","observation_id":"d23abe1b-faf4-423c-8e6e-0f1d0afb70cc","resolution":{"observed_at":"2026-08-07T14:57:50.315240Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:54.353970Z","title":"Dynamical regimes of diffusion models, 2024","venue":null,"work_id":"9c5ecc88-e1cb-406b-9c94-668027fc0d93","year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.395124Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:96157195eebeaad7f87ac58227c79e9cca742cfae301ede32a2e4330a8a8b256","observation_id":"cb9a3194-5749-4752-91dd-0d3fa9bd05c0","resolution":{"observed_at":"2026-08-07T14:57:54.409917Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.17467","last_updated":"2024-06-20T08:39:11Z","snapshot_observed_at":"2026-08-19T12:30:47.867363Z","submitted_at":"2023-10-26T15:15:01Z","title":"The statistical thermodynamics of generative diffusion models: Phase transitions, symmetry breaking and critical instability","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.17467","snapshot_observed_at":"2026-08-07T14:57:50.518052Z","title":"The statistical thermodynamics of generative diffusion models","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.518052Z"},"links":{"cited_paper":"/paper/2310.17467","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:96e37b22d7aac14d8b36602279134aa1f1ec7c080a4707842fe3b5e1ce9db893","observation_id":"6d2dc688-64d7-45d0-a301-37282ee1997d","resolution":{"observed_at":"2026-08-07T14:57:50.518052Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:50.650669Z","title":"Losing dimensions: Geometric memorization in generative diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.650669Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:48f9edf12364db44b885271f76246c3f0edac7aa34ec892f34b3ee519e583777","observation_id":"9c7ed5e5-0659-4d4e-9eb4-eb883d1db70d","resolution":{"observed_at":"2026-08-07T14:57:50.650669Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.09578","last_updated":"2025-05-25T10:42:24Z","snapshot_observed_at":"2026-08-09T07:25:19.313278Z","submitted_at":"2025-02-13T18:36:07Z","title":"Memorization and Generalization in Generative Diffusion under the Manifold Hypothesis","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2502.09578","snapshot_observed_at":"2026-08-07T14:57:50.773883Z","title":"Memo- rization and generalization in generative diffusion under the manifold hypothesis.arXiv preprint arXiv:2502.09578, 2025","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.773883Z"},"links":{"cited_paper":"/paper/2502.09578","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:42e4703e3182d1ee2dc35795eab12a76d7c9428bdd22333ef7571059d6f35e71","observation_id":"85170d80-ff68-429e-99e4-40928e285d0d","resolution":{"observed_at":"2026-08-07T14:57:50.773883Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:54.207205Z","title":"Critical windows: non-asymptotic theory for feature emergence in diffusion models","venue":null,"work_id":"3d690e36-c247-4497-aa3d-f05583e1c41a","year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.846511Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:e1b36788d36c3ce2dc77911935a8389026384ae1fe3cac6244f01b47b80d0d9d","observation_id":"8dafb21b-363f-42ea-b51a-15b40ab4bb91","resolution":{"observed_at":"2026-08-07T14:57:54.274620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.03575","last_updated":"2024-06-25T16:32:20Z","snapshot_observed_at":"2026-08-21T09:52:50.136137Z","submitted_at":"2023-10-05T14:53:40Z","title":"Analysis of learning a flow-based generative model from limited sample complexity","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.03575","snapshot_observed_at":"2026-08-07T14:57:50.901824Z","title":"Analysis of learning a flow-based generative model from limited sample complexity.arXiv preprint arXiv:2310.03575, 2023","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.901824Z"},"links":{"cited_paper":"/paper/2310.03575","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:f4743cea17ae9f27190f53645ab5629136b5c06f0e4069412d9cda614bad84b4","observation_id":"7f8f1251-a559-488b-a729-d186e4e963f6","resolution":{"observed_at":"2026-08-07T14:57:50.901824Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:50.996477Z","title":"Learning mixtures of gaussians using the ddpm objective","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:50.996477Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:d605d422ea926a445c270f4f275459d0065e487109cbce2a3999a2d8ceab0b9f","observation_id":"550350ca-b8be-46a1-b28d-7317af4197eb","resolution":{"observed_at":"2026-08-07T14:57:50.996477Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.15604","last_updated":"2026-04-18T00:02:53Z","snapshot_observed_at":"2026-08-20T07:39:53.806552Z","submitted_at":"2024-01-28T08:13:56Z","title":"Neural Network-Based Score Estimation in Diffusion Models: Optimization and Generalization","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.15604","snapshot_observed_at":"2026-08-07T14:57:51.070028Z","title":"Neural network-based score estimation in diffusion models: Optimization and generalization","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:51.070028Z"},"links":{"cited_paper":"/paper/2401.15604","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:56b0485beb381340f0260fb6a242a72a49925b98e2b81375c1e5d3edc042ff49","observation_id":"c480d312-f706-447b-90c0-7a4b64c08840","resolution":{"observed_at":"2026-08-07T14:57:51.070028Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:51.171919Z","title":"Denoising score matching with random features: Insights on diffusion models from precise learning curves","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:51.171919Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:3d61bd074a0b89db1c3cda95e548ff7c95b4362c975794115b225cac12122da2","observation_id":"b85b1526-c6a2-45bf-bcd5-1b7d5981bb15","resolution":{"observed_at":"2026-08-07T14:57:51.171919Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:54.053476Z","title":"On the generalization properties of diffusion models","venue":null,"work_id":"4372e076-17c5-4864-8da5-314249f9776e","year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:51.292761Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:c27166f04fe73698f09c9485f52c53e7a01d4f3b663ab5d5d3061eab6d5b0522","observation_id":"fabbbfd3-0b48-4436-89ba-144239751dd1","resolution":{"observed_at":"2026-08-07T14:57:54.117440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.03518","last_updated":"2023-08-24T10:44:18Z","snapshot_observed_at":"2026-08-16T15:26:14.919309Z","submitted_at":"2023-06-06T09:10:03Z","title":"Generative diffusion in very large dimensions","version":3},"cited_work":{"arxiv_id":"2306.03518","doi":null,"metadata_source":"pith","pith_arxiv_id":"2306.03518","snapshot_observed_at":"2026-08-07T14:57:52.835360Z","title":"Generative diffusion in very large dimensions","venue":"cond-mat.dis-nn","work_id":"4ae91ef0-ccee-4318-ba03-984a0e9cb140","year":2023},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:51.452580Z"},"links":{"cited_paper":"/paper/2306.03518","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:d952f4f4356dd8e9e0d93e1e3169c5a2bb32d4cc168000daad7966646866d08a","observation_id":"b126b20e-46e3-4b23-b6c6-47e00d7ee57e","resolution":{"observed_at":"2026-08-07T14:57:52.883121Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20292","last_updated":"2025-06-05T05:09:27Z","snapshot_observed_at":"2026-08-16T08:43:12.375693Z","submitted_at":"2024-12-28T22:33:29Z","title":"An analytic theory of creativity in convolutional diffusion models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.20292","snapshot_observed_at":"2026-08-07T14:57:51.559529Z","title":"An analytic theory of creativity in convolutional diffusion models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:51.559529Z"},"links":{"cited_paper":"/paper/2412.20292","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:98f1e592277388a1ab20952dca1af317fe9cbc59d03f1cbd41a71a34279a4788","observation_id":"346fd06d-57f1-48df-a048-332ef855b60e","resolution":{"observed_at":"2026-08-07T14:57:51.559529Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2404.18444","last_updated":"2024-05-01T16:49:57Z","snapshot_observed_at":"2026-08-17T20:34:03.038727Z","submitted_at":"2024-04-29T05:57:03Z","title":"U-Nets as Belief Propagation: Efficient Classification, Denoising, and Diffusion in Generative Hierarchical Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2404.18444","snapshot_observed_at":"2026-08-07T14:57:51.655432Z","title":"U-nets as belief propagation: Efficient classification, denoising, and diffusion in generative hierarchical models","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:51.655432Z"},"links":{"cited_paper":"/paper/2404.18444","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:de8e086b0028f9567b6933c59e2b19d3f0b8dd30070fd3f80c96a390437c8fc6","observation_id":"8a026a36-be02-4411-82b4-92845da3c93c","resolution":{"observed_at":"2026-08-07T14:57:51.655432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2408.15138","last_updated":"2025-06-10T08:51:44Z","snapshot_observed_at":"2026-08-20T10:40:30.071139Z","submitted_at":"2024-08-27T15:23:09Z","title":"How transformers learn structured data: insights from hierarchical filtering","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.15138","snapshot_observed_at":"2026-08-07T14:57:51.762842Z","title":"How transformers learn structured data: insights from hierarchical filtering","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:51.762842Z"},"links":{"cited_paper":"/paper/2408.15138","citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:7d4e67c4a5680d504b33e35073707c28c6a316f5786c33358884c92f49282bd6","observation_id":"7fd7dd6b-00b2-4b82-a2c4-6406ec086cca","resolution":{"observed_at":"2026-08-07T14:57:51.762842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:53.929417Z","title":"Advani, Andrew M","venue":null,"work_id":"9ddfd345-2f0b-43e5-bc72-67682f308237","year":2020},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:51.899974Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:7bed3a7e1972f600dfd4d24d413b1015047bf4498c02f8a0fbfe696361c3b79a","observation_id":"d794ebd3-985b-4028-82b0-a660e171bb76","resolution":{"observed_at":"2026-08-07T14:57:53.994843Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:52.002800Z","title":"Deep double descent: Where bigger models and more data hurt.Journal of Statistical Mechanics: Theory and Experiment, 2021(12):124003, 2021","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:52.002800Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:bdf022d4d14a92d0fdeed0ce938706116a91b151a7c0cec5a29fced49a249314","observation_id":"1b81fdb4-2030-472d-8192-61c19605e37d","resolution":{"observed_at":"2026-08-07T14:57:52.002800Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:52.108551Z","title":"Dynamical decoupling of generalization and overfitting in large two-layer networks","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:52.108551Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:d20175d39a9c6a709e4dfa6b6831b5feff54a406eb0618edd000e04d58e6ef02","observation_id":"a6c960cc-d995-4add-876d-4119e91284aa","resolution":{"observed_at":"2026-08-07T14:57:52.108551Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:53.810154Z","title":"Spigler, M","venue":null,"work_id":"d5997ea5-20f8-4339-90f0-511a11131442","year":2019},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:52.160249Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:8f989c016595ba4c07027bf831135d3814ba246039b09599f50873d0bc117d98","observation_id":"1dd990fa-72e5-4615-89ce-040701788449","resolution":{"observed_at":"2026-08-07T14:57:53.856724Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:52.264858Z","title":"Reconciling modern machine- learning practice and the classical bias–variance trade-off.Proceedings of the National Academy of Sciences, 116(32):15849–15854, 2019","venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:52.264858Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:6024087eff6f988a6799e4cf4e67a9afd6d88ffd54aadda1d01755b9466435dc","observation_id":"39b297f5-e6b9-469b-8ce1-709f0ee69b71","resolution":{"observed_at":"2026-08-07T14:57:52.264858Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:52.401474Z","title":"Benign overfitting in linear regression","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:52.401474Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:dad193d4bd30fdfdbfc4d0a558e4305503e80a14457d120df2d6d2768b249407","observation_id":"045b196b-a615-48a3-9dc1-32143aedc7bd","resolution":{"observed_at":"2026-08-07T14:57:52.401474Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:53.690473Z","title":"A self- supervised descriptor for image copy detection","venue":null,"work_id":"b6706af1-9d65-450b-b59f-f5933174aeba","year":2022},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:52.508554Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:802f381d295d305b2389570b05eaacb23d91496e41be624813634e385440f3bb","observation_id":"752a6f73-900b-45f8-87c7-56731de65727","resolution":{"observed_at":"2026-08-07T14:57:53.745996Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-07T14:57:53.504578Z","title":"A mean field view of the landscape of two-layer neural networks","venue":null,"work_id":"4878af95-08f3-40ae-9ffd-47f66e10b051","year":2018},"citing_paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models","version":2},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-07T14:57:52.599683Z"},"links":{"citing_paper":"/paper/2505.16959"},"observation_digest":"sha256:cecf1152e053e6af39e0e1afdc412e3448834eebf393dc65539bb4dd65068f74","observation_id":"874080c9-b57e-4c97-b49a-c005f854bc1d","resolution":{"observed_at":"2026-08-07T14:57:53.602933Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-22T06:32:14.747728+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.16959","last_updated":"2025-09-01T20:18:07Z","latest_version":2,"primary_category":"cs.LG","snapshot_observed_at":"2026-08-19T20:52:10.937383Z","submitted_at":"2025-05-22T17:40:08Z","title":"Bigger Isn't Always Memorizing: Early Stopping Overparameterized Diffusion Models"},"reference_resolution":{"displayed":82,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":53,"verified_exact":1,"verified_fuzzy":28},"total_outbound_references":82},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-22T06:32:14.747728+00:00","source":"crossref"},{"observed_at":"2026-08-22T06:32:06.552537+00:00","source":"retraction_watch"}],"thesis":"As of 23 August 2026, this Paper Citation Record lists 82 of 82 outbound references and 8 inbound Pith citation observations for arXiv:2505.16959."}