{"as_of":"2026-08-05T02:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:aa990fda3a12e34994ce5c5b8c87cc2e13553c3d0aa0a2320421f3ebaf534e8f","coverage":[{"denominator":42,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":42,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-01T08:07:10.345273Z","state":"measured"},{"denominator":42,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":42,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-04T06:34:03.388597+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2605.00273/citation-record","integrity":"/paper/2605.00273/integrity","json":"/paper/2605.00273/citation-record.json","paper":"/paper/2605.00273"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.17638","doi":"10.48550/arxiv.2505.17638","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"& Mézard, M.Why Diffusion Models Don’t Memorize: The Role of Implicit Dynamical Regularization in TrainingarXiv:2505.17638 [cs]","venue":"HAL (Le Centre pour la Communication Scientifique Directe)","work_id":"8d093768-810c-4001-906b-d7feae97c429","year":2025},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:3893a2e45209eb83c2afde1511b6f7bcd6968ecd2bb72b3381e8a799b78fe186","observation_id":"acfb3be9-710d-49fd-8a1f-d53a41f97f9a","resolution":{"observed_at":"2026-07-01T08:15:31.923667Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2511.11253","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T08:15:31.916026Z","title":"Countsteer: Steering attention for object counting in diffusion models.arXiv preprint arXiv:2511.11253,","venue":null,"work_id":"2887d93d-935c-44a4-86f6-0e142c18e2a6","year":null},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:2a6b04512139f76eaa27f5f6d6b693f40cd5d2043ae4707f0d3c81f0a3f9685f","observation_id":"850f2cd5-b7de-41b7-8d85-f7fb0af70361","resolution":{"observed_at":"2026-07-01T08:15:31.919104Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2509.16447","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:26:43.211323Z","title":"Local mechanisms of compositional generalization in conditional diffusion","venue":null,"work_id":"c7749039-4ba7-4242-bf28-c8df2b3e6fb9","year":2025},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:f18e436a88aa70c1c03abe18ec1919ee5e17661caa1955cbbb1c12e9ac31247a","observation_id":"e270e4fd-908f-4181-8700-121895dd69c4","resolution":{"observed_at":"2026-07-01T08:15:31.914001Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00426","last_updated":"2023-12-29T16:42:08Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-09-30T16:18:00Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":"2310.00426","doi":"10.48550/arxiv.2310.00426","metadata_source":"pith","pith_arxiv_id":"2310.00426","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"PixArt-$\\alpha$: Fast Training of Diffusion Transformer for Photorealistic Text-to-Image Synthesis","venue":"cs.CV","work_id":"77157568-e4be-4041-bb20-388177fc59d0","year":2023},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2310.00426","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:12d14bc8027a82dee10acebc28f3cc27300e3e64f64e2d8d821805eb16861141","observation_id":"b8b22434-d16b-4090-9643-572d14c202c4","resolution":{"observed_at":"2026-07-01T08:15:32.073008Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-14T13:49:58.428012+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-14T13:49:58.428012+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2303.09166","last_updated":"2023-03-16T09:14:26Z","snapshot_observed_at":"2026-08-04T08:50:28.797726Z","submitted_at":"2023-03-16T09:14:26Z","title":"Identifiability Results for Multimodal Contrastive Learning","version":1},"cited_work":{"arxiv_id":"2303.09166","doi":"10.48550/arxiv.2303.09166","metadata_source":"arxiv_reference","pith_arxiv_id":"2303.09166","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Identifia- bility results for multimodal contrastive learning.arXiv preprint arXiv:2303.09166","venue":"arXiv (Cornell University)","work_id":"c1baeb00-85b5-4243-b60a-fa12320c2437","year":2023},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2303.09166","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:9e483027546d0c75edf349ad7cf1b7921390c7d4a7857efeadb6fd192cae4c26","observation_id":"0cac837c-ce63-4b3a-a17c-a6887d1c5745","resolution":{"observed_at":"2026-07-01T08:15:32.077282Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.22118","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T08:15:32.063894Z","title":"A., and Zaharia, M","venue":null,"work_id":"7463cab1-da9c-4d68-9c2a-cf3ccf8bae91","year":null},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:ca3df6e0092e73191e6adf1d26782d11c1c4a1f3f66383361571a10a604eb662","observation_id":"ebbc73c0-dbe9-45d6-b3d7-ddd72cae66af","resolution":{"observed_at":"2026-07-01T08:15:32.067435Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2510.03075","last_updated":"2026-04-27T13:02:22Z","snapshot_observed_at":"2026-07-06T22:31:40.462674Z","submitted_at":"2025-10-03T15:02:27Z","title":"What Drives Compositional Generalization? The Importance of Continuous Training Objectives in Visual Generative Models","version":3},"cited_work":{"arxiv_id":"2510.03075","doi":null,"metadata_source":"pith","pith_arxiv_id":"2510.03075","snapshot_observed_at":"2026-07-10T12:47:05.570796Z","title":"What Drives Compositional Generalization? The Importance of Continuous Training Objectives in Visual Generative Models","venue":"cs.CV","work_id":"a9f93a15-ff08-44ef-8613-7fe2f345caa8","year":2025},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2510.03075","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:4c5aa9a90108fcbfc6f708c86daa8f03564f117a56eb08b9a619be3aff955517","observation_id":"e9ad0629-5a2c-44e0-8775-6840e82abdd5","resolution":{"observed_at":"2026-07-01T08:15:32.041741Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.147234Z","title":"Early-stopping too late? traces of memorization be- fore overfitting in generative diffusion","venue":null,"work_id":"bdddfca4-caa1-4dba-8c05-57e5e013409e","year":2025},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:fc84f057e69fb82c340cab1671e9e4b547d71992018505da7f6bbb0d86c1d48c","observation_id":"b557a306-0d19-48cd-8212-2bb4953064f3","resolution":{"observed_at":"2026-07-06T13:32:34.148705Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2106.09685","last_updated":"2021-10-16T18:40:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2021-06-17T17:37:18Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","version":2},"cited_work":{"arxiv_id":"2106.09685","doi":"10.4088/pcc.v03n0609","metadata_source":"pith","pith_arxiv_id":"2106.09685","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"LoRA: Low-Rank Adaptation of Large Language Models","venue":"cs.CL","work_id":"0426219a-789e-4964-adc8-a04538510818","year":2021},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2106.09685","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:08c8e77b1df7437665ad4ee90e70199b6238f4857768cac69270950884266646","observation_id":"b09db714-4c3a-4780-86b5-885e42dbacd3","resolution":{"observed_at":"2026-07-01T08:15:32.081490Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.17955","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T08:15:31.934946Z","title":"Diffusion classifiers understand compositionality, but conditions apply.arXiv preprint arXiv:2505.17955, 2","venue":null,"work_id":"593ccf72-9bdc-45aa-ae77-0d09ffd80c54","year":2025},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:ee4ed6ece73a2c8c9e6f0dc3ffa587003ebdfdb142b7f25cf464bdeb6af9b84a","observation_id":"d448f3cf-0a0c-4062-9664-74a23b754d86","resolution":{"observed_at":"2026-07-01T08:15:31.937551Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.20292","last_updated":"2025-06-05T05:09:27Z","snapshot_observed_at":"2026-08-04T15:22:13.885403Z","submitted_at":"2024-12-28T22:33:29Z","title":"An analytic theory of creativity in convolutional diffusion models","version":2},"cited_work":{"arxiv_id":"2412.20292","doi":"10.48550/arxiv.2412.20292","metadata_source":"arxiv_reference","pith_arxiv_id":"2412.20292","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An analytic theory of creativity in convolutional diffusion models","venue":"arXiv (Cornell University)","work_id":"f18f1029-2aef-47f7-89fb-2b09fdf163d7","year":1960},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2412.20292","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:13381d15fa4a8819c1b6693b0a418283ba7f0565f702cccc8269208295cea21a","observation_id":"e8c71984-eb6f-44cb-a05f-c39d13411e80","resolution":{"observed_at":"2026-07-01T08:15:32.086639Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2411.02385","last_updated":"2025-06-22T03:30:55Z","snapshot_observed_at":"2026-08-02T22:45:54.982294Z","submitted_at":"2024-11-04T18:53:05Z","title":"How Far is Video Generation from World Model: A Physical Law Perspective","version":2},"cited_work":{"arxiv_id":"2411.02385","doi":null,"metadata_source":"pith","pith_arxiv_id":"2411.02385","snapshot_observed_at":"2026-07-08T07:14:45.230404Z","title":"How Far is Video Generation from World Model: A Physical Law Perspective","venue":"cs.CV","work_id":"4459ec7e-7a67-4b25-9c04-e91d87bf1b63","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2411.02385","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:4a145bc1d1eb50ee963b79bfc3aef69cd9d942c3118f7aaae153a14246407f1c","observation_id":"84e90ae3-1ffc-4cf1-a269-c3c47ac644eb","resolution":{"observed_at":"2026-07-01T08:15:32.091023Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2510.03886","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T08:15:31.993469Z","title":"Rare text semantics were always there in your diffusion transformer","venue":null,"work_id":"192f6875-9eb7-4b89-9a9a-777410948ef2","year":2025},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:3a165f6ee87027dee0c48c179aa5a452b9a2d8db0d96c1f8973ad9d512f99008","observation_id":"913c2c90-8bb3-4302-9963-933f3b884305","resolution":{"observed_at":"2026-07-01T08:15:31.996271Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":"1312.6114","doi":"10.2139/ssrn.4269703","metadata_source":"pith","pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Auto-Encoding Variational Bayes","venue":"stat.ML","work_id":"97d95295-30e1-42b4-bbf6-85f0fa4edb44","year":2013},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:efa3d392e374afbac8671c8b0897c88927d2b12950db50525fab2b72d35c8132","observation_id":"62d3eece-3623-4956-b62a-7d93620037e4","resolution":{"observed_at":"2026-07-01T08:15:32.037344Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":"1711.05101","doi":"10.1137/1.9781611972825.47","metadata_source":"pith","pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Decoupled Weight Decay Regularization","venue":"cs.LG","work_id":"07ef7360-d385-4033-83f7-8384a6325204","year":2017},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:a45d76b39fa33297aff8bc22973775db87dde2231231cfed1439fd02f791414f","observation_id":"6bb9b5f4-139c-42d6-9c5b-ef066bd4aa2f","resolution":{"observed_at":"2026-07-01T08:15:32.021693Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1807.03748","last_updated":"2019-01-22T18:47:12Z","snapshot_observed_at":"2026-07-06T06:49:24.960992Z","submitted_at":"2018-07-10T16:52:11Z","title":"Representation Learning with Contrastive Predictive Coding","version":2},"cited_work":{"arxiv_id":"1807.03748","doi":"10.1609/aaai.v36i10.21390","metadata_source":"pith","pith_arxiv_id":"1807.03748","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Representation Learning with Contrastive Predictive Coding","venue":"cs.LG","work_id":"7b08a1d4-d565-424e-9c86-6ef244b7b90a","year":2018},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/1807.03748","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:79e1c13c1ba07fd24bd9b02de2a7e68f51525c43991ffa152dd8b72fdb4f9628","observation_id":"b3a92b61-f631-4562-b38d-ef152a27f9a4","resolution":{"observed_at":"2026-07-01T08:15:31.981493Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1511.08458","last_updated":"2015-12-02T18:06:03Z","snapshot_observed_at":"2026-07-06T04:37:52.737823Z","submitted_at":"2015-11-26T17:45:01Z","title":"An Introduction to Convolutional Neural Networks","version":2},"cited_work":{"arxiv_id":"1511.08458","doi":"10.48550/arxiv.1511.08458","metadata_source":"pith","pith_arxiv_id":"1511.08458","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"An Introduction to Convolutional Neural Networks","venue":"cs.NE","work_id":"ecc2da61-e6b9-433b-bb19-bb411af03d12","year":2015},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/1511.08458","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:b0e4b042632367549d29aee2be82f84abc58343503d24499ca94b6f5c0000165","observation_id":"97dca175-feeb-44ca-88e3-6ad8d3f18e11","resolution":{"observed_at":"2026-07-01T08:15:32.000660Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-07-13T12:19:55.457832+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-13T12:19:55.457832+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2505.21777","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T01:26:43.234117Z","title":"Memorization to generalization: Emergence of diffusion models from associative memory","venue":null,"work_id":"edd25385-1932-4d8b-8966-6ca5458a44d0","year":2025},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:e63d60a32d4815dd1f822f75b04aaba0d1693b209beb30fb5a02b2a333f2040f","observation_id":"0a9f729a-3eca-44f0-b97d-1e75a389b2a6","resolution":{"observed_at":"2026-07-01T08:15:31.987242Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":"2307.01952","doi":"10.48500/arxiv.2307.01952","metadata_source":"pith","pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","venue":"cs.CV","work_id":"8034c587-fba6-4941-87ba-c98f2ac962cb","year":2023},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:7f1637d3b169d2b4a8861dc77df36e8818cdff1abacf95aeca3b9decd87e92fa","observation_id":"2ef24aa6-5801-4580-842a-bbcc3f3218f9","resolution":{"observed_at":"2026-07-01T08:15:32.012424Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.10768","last_updated":"2025-07-14T19:46:54Z","snapshot_observed_at":"2026-07-06T21:57:12.341146Z","submitted_at":"2025-07-14T19:46:54Z","title":"Spatial Reasoners for Continuous Variables in Any Domain","version":1},"cited_work":{"arxiv_id":"2507.10768","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.10768","snapshot_observed_at":"2026-07-01T08:15:32.024656Z","title":"Ramesh, A., Dhariwal, P., Nichol, A., Chu, C., and Chen, M","venue":null,"work_id":"9d98b617-b22d-4663-bbd0-bc8ebbf5a253","year":null},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2507.10768","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:2d195ad7ee9f8e1686120dd1e4bfe37420c185bc29ce73d99860b3045aadf6d5","observation_id":"d96b27bc-341a-4d7e-b0e7-cb86e1ba26ad","resolution":{"observed_at":"2026-07-01T08:15:32.030894Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.145015Z","title":"U-net: Con- volutional networks for biomedical image segmenta- tion","venue":null,"work_id":"68279353-aeb8-42a9-943a-2a97e3779905","year":2015},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:44744bf0a827da3b0c6d4b658cfdcbb7d008fba528d7c1d9917d141fc9833cd7","observation_id":"801ebdc8-e2a3-4fc2-a4fa-3fc5ca2f8c6f","resolution":{"observed_at":"2026-07-06T13:32:34.146633Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2011.13456","last_updated":"2021-02-10T18:17:04Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-11-26T19:39:10Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":"2011.13456","doi":"10.1088/1748-9326/aae98d","metadata_source":"pith","pith_arxiv_id":"2011.13456","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Score-Based Generative Modeling through Stochastic Differential Equations","venue":"cs.LG","work_id":"d9110e53-a5d4-4794-a4c5-a575e91c31ad","year":2020},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2011.13456","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:6682a3a09ef49707ab886a4c3de3e7cd95e4065112f6135c91a3e5676bce0418","observation_id":"841e1b10-d082-40dd-a4d8-807f22d120c0","resolution":{"observed_at":"2026-07-01T08:15:31.960621Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-06-01T22:58:00.812405+00:00","source":"crossref_status_cache"},{"observed_at":"2026-06-01T22:58:00.812405+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":"2505.09388","doi":"10.1016/j.aiopen.2022.12","metadata_source":"pith","pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-07-11T11:50:26.030339Z","title":"Qwen3 Technical Report","venue":"cs.CL","work_id":"25a4e30c-1232-48e7-9925-02fa12ba7c9e","year":2025},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:954c7baa59e0b1af68b43a50121cf80934d469e5c684d38a0a2776c5c0d98c9e","observation_id":"b9247553-0596-4f37-a64c-4f2baaa40b4d","resolution":{"observed_at":"2026-07-01T08:15:31.991490Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2403.05846","last_updated":"2024-10-21T09:38:03Z","snapshot_observed_at":"2026-07-06T17:41:59.818493Z","submitted_at":"2024-03-09T09:11:49Z","title":"Diffusion Lens: Interpreting Text Encoders in Text-to-Image Pipelines","version":2},"cited_work":{"arxiv_id":"2403.05846","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2403.05846","snapshot_observed_at":"2026-07-01T08:15:32.093161Z","title":"Diffusion lens: Interpreting text encoders in text-to- image pipelines.arXiv preprint arXiv:2403.05846,","venue":null,"work_id":"999c25cf-8e5f-45d7-b0ac-a96b6d9aa82e","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2403.05846","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:1748162457bf577ece631fb36334a1dfc35b394ab76e3b5649c0b51bf98e1282","observation_id":"e2a43987-5922-4288-bdc8-f45caad6ffad","resolution":{"observed_at":"2026-07-01T08:15:32.095589Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2507.07102","last_updated":"2025-07-09T17:59:03Z","snapshot_observed_at":"2026-07-06T21:54:38.722088Z","submitted_at":"2025-07-09T17:59:03Z","title":"Does Data Scaling Lead to Visual Compositional Generalization?","version":1},"cited_work":{"arxiv_id":"2507.07102","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2507.07102","snapshot_observed_at":"2026-07-01T08:15:31.948464Z","title":null,"venue":null,"work_id":"16cc6eb8-8d8f-4657-bbaa-d989baaea871","year":null},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2507.07102","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:4e71405666788648c462ee70d3129c9c541c134c536eba4f34d76fb625eed3b6","observation_id":"3678f4b4-059d-4ba0-91a3-cc29fb50c806","resolution":{"observed_at":"2026-07-01T08:15:31.950637Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.21075","last_updated":"2025-06-10T18:54:54Z","snapshot_observed_at":"2026-07-06T20:44:22.327776Z","submitted_at":"2025-02-28T14:08:30Z","title":"Spatial Reasoning with Denoising Models","version":2},"cited_work":{"arxiv_id":"2502.21075","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.21075","snapshot_observed_at":"2026-07-02T16:37:09.229123Z","title":"arXiv preprint arXiv:2502.21075 , year =","venue":null,"work_id":"860f9369-9c2e-4388-9225-d648ebc0be04","year":2025},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2502.21075","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:82dd7d9f18f066ada8a877328a89c545f2ebc3bfec7dc938e41d64bc05f04836","observation_id":"6a3550e8-58dd-45a9-8e05-392315479139","resolution":{"observed_at":"2026-07-01T08:15:31.955771Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2502.18326","last_updated":"2025-02-17T16:52:02Z","snapshot_observed_at":"2026-07-06T20:42:29.090543Z","submitted_at":"2025-02-17T16:52:02Z","title":"Pretraining Frequency Predicts Compositional Generalization of CLIP on Real-World Tasks","version":1},"cited_work":{"arxiv_id":"2502.18326","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2502.18326","snapshot_observed_at":"2026-07-01T08:15:31.925637Z","title":"Pretraining frequency predicts compositional generalization of clip on real-world tasks.arXiv preprint arXiv:2502.18326,","venue":null,"work_id":"efc6ed5b-4d24-4194-a300-5e941e5fe63f","year":null},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2502.18326","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:9449a9ccd9b43ec2ae8d75c30f38c1fbfc4607ac3a3a33c7201a0e69ebbf0886","observation_id":"cd027f51-8c1e-4cef-988d-a3d0db6747ca","resolution":{"observed_at":"2026-07-01T08:15:31.928425Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2409.11340","last_updated":"2024-11-21T14:09:12Z","snapshot_observed_at":"2026-07-06T19:16:51.512681Z","submitted_at":"2024-09-17T16:42:46Z","title":"OmniGen: Unified Image Generation","version":2},"cited_work":{"arxiv_id":"2409.11340","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2409.11340","snapshot_observed_at":"2026-07-03T00:47:29.709700Z","title":"OmniGen: Unified Image Generation","venue":null,"work_id":"31a240e8-a9e7-406e-8c54-62cdc33a957c","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2409.11340","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:de16c32180835b68c14c45269e1d7a95b665cdcc106ea5a9ebc8b8c7d4a6be56","observation_id":"11477df5-e65c-4e22-9cd9-86acdd606f1b","resolution":{"observed_at":"2026-07-01T08:15:31.941960Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.18653","last_updated":"2024-12-24T19:00:02Z","snapshot_observed_at":"2026-07-06T20:12:59.152345Z","submitted_at":"2024-12-24T19:00:02Z","title":"1.58-bit FLUX","version":1},"cited_work":{"arxiv_id":"2412.18653","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.18653","snapshot_observed_at":"2026-07-01T08:15:31.930344Z","title":"1.58-bit FLUX","venue":null,"work_id":"ef79fd9b-49f9-450d-b52a-c228a816bf40","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2412.18653","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:a6086150f5e925bac5b149b782193fd8ab599e8540b2629ab276f1f71d4f3bff","observation_id":"5e5983b5-3dbc-4479-9b3e-56b8e2a0365e","resolution":{"observed_at":"2026-07-01T08:15:31.933006Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2410.17385","last_updated":"2025-04-17T17:59:27Z","snapshot_observed_at":"2026-07-06T19:38:04.948333Z","submitted_at":"2024-10-22T19:39:15Z","title":"Do Vision-Language Models Represent Space and How? Evaluating Spatial Frame of Reference Under Ambiguities","version":2},"cited_work":{"arxiv_id":"2410.17385","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2410.17385","snapshot_observed_at":"2026-07-02T21:07:24.216562Z","title":"Do vision-language models represent space and how? eval- uating spatial frame of reference under ambiguities","venue":null,"work_id":"f53c4559-e7da-40a9-935f-1e53b931b6be","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"cited_paper":"/paper/2410.17385","citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:7e8675d120b73651d269ad6f9bab288f02668e527a5163e7f6c7731d71c87035","observation_id":"c9abb6af-23de-4bc7-9c52-8f506d4a8604","resolution":{"observed_at":"2026-07-01T08:15:31.946430Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.159286Z","title":"1” or “one","venue":null,"work_id":"8ef5d6da-a697-46ab-81a2-ec5802f38cb8","year":2022},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:1e89e11e227643d5bc0f13b5b50eb0653ff40b5bce062463368eb5f59dd4d908","observation_id":"9efa2850-67bc-45ff-9c1c-c72c7f2c4866","resolution":{"observed_at":"2026-07-06T13:32:34.160544Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.156969Z","title":"Prompt:Find number words (one, two, three, four, five, six, seven, eight, nine, ten) that appear next to or very close to nouns describing countable physical things of any size","venue":null,"work_id":"d6beaf3e-305a-4bf9-a28f-bd0a19e004b0","year":2019},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:8f47efa59fbc8a189ae5a6f5f7e93774c8f25ba51a61d457145455740b0bbd1e","observation_id":"9a691c44-6259-4290-95ae-67b025cd0426","resolution":{"observed_at":"2026-07-06T13:32:34.158689Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.141312Z","title":"Following their object list, we uniformly generate 830 prompts for each target count","venue":null,"work_id":"0ceaf401-f9e9-4261-b0ab-6c0286c95609","year":2023},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:c7815616a36bebc2ce82532c630ba31d553bbe4db9e1c40cc2410594e619ad24","observation_id":"182c46ce-a5c8-4ce5-b35a-8afd292e640d","resolution":{"observed_at":"2026-07-06T13:32:34.142589Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.154907Z","title":"in front of","venue":null,"work_id":"b806d4ea-f66c-4039-89ec-bbcbf2c4a972","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:d1824a7e69480f4224883ff4e95c2e57ff6bf237d4a4b5e6996a6070a9c3c370","observation_id":"d8706b16-6f34-41b7-b5f5-b7827695918a","resolution":{"observed_at":"2026-07-06T13:32:34.156141Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.153051Z","title":"For example, in a 100k dataset, theskeweddistribution allocates (22,550, 17,950, 14,350, 11,450, 9,150, 7,300, 5,850, 4,650, 3,750, 3,000) samples across the ten classes","venue":null,"work_id":"86f66e5f-7df3-452d-bd73-4c1a790c3a80","year":2025},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:32e6cbcc6495cf78091807781f6342c3da897eb4c2aaac703d9ba73014578ef7","observation_id":"137c67bb-adf5-426d-bea0-fb650981d81e","resolution":{"observed_at":"2026-07-06T13:32:34.154298Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"0010.9560","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-01T08:15:32.097801Z","title":null,"venue":null,"work_id":"6df204f2-fc3e-4f68-9b99-0711ac8af4e7","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:945a8b221d2a32da773dcb8379a0cff1d3af286ede1d225247c5a44360699839","observation_id":"700d328d-8a7c-4516-ac9d-61f5247317f5","resolution":{"observed_at":"2026-07-01T08:15:32.100066Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.161726Z","title":"We adopt the DiT architecture from SD3 (Esser et al.,","venue":null,"work_id":"5ddc05fb-c847-48c5-ba53-3fd2ffa3cc69","year":2023},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:647a1a58daea8a8fcb0b0afeb57fd0f45118101d6fdc1fa4f9381da2dcd3e407","observation_id":"bbd22f74-d2c5-410e-97ec-b9e66e709bd1","resolution":{"observed_at":"2026-07-06T13:32:34.163105Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.139424Z","title":"To ensure comparable image quality across architectures, we fix the V AE to the one used in SD2, which is also used for all UNet-based experiments in this work","venue":null,"work_id":"99586419-5b96-4875-bcfa-5d4c83cd49fd","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:447290dacb143021dbfb13d3207335c093f8b591deea950a760b3eb0582665b2","observation_id":"8414e094-dd20-433f-a152-31f0aaeef6c2","resolution":{"observed_at":"2026-07-06T13:32:34.140744Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.143150Z","title":null,"venue":null,"work_id":"842ba15e-e8c6-4f53-a732-dd3ec95909c4","year":2000},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:21a3eedaf94979c0e729640f55177055e1ab44b2078cdc2fe49cbba9b434f2a2","observation_id":"ec8ab48c-3137-4e1b-986b-6f2db6076df9","resolution":{"observed_at":"2026-07-06T13:32:34.144204Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.149363Z","title":"We also evaluate a frozen condition encoder (red) that is pretrained with cross-entropy loss and not jointly optimized with the diffusion model","venue":null,"work_id":"a7f3c2e0-e6d8-4c1a-85f6-23640eea036b","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:f6b52d1990b23c22cd27adbc861ce183bfcfb70902f188cb39e8090c62f59bb3","observation_id":"e99f01ea-45f9-41d6-9439-3a74ced19d81","resolution":{"observed_at":"2026-07-06T13:32:34.150687Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.151253Z","title":null,"venue":null,"work_id":"32af576c-0e84-4055-8e66-5739755ee61c","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:d255b2a4cf4dc748c306c541a4e3b9ec9742d9722990a8b7198e2dd7065366ad","observation_id":"b4e47176-c889-4877-8fe8-7caddfec2b7c","resolution":{"observed_at":"2026-07-06T13:32:34.152445Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-06T13:32:34.137398Z","title":"26 When Do Diffusion Models learn to Generate Multiple Objects? A.3.2","venue":null,"work_id":"3d2065fb-4200-40bd-8141-d9da10bf694f","year":2024},"citing_paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-07-01T08:07:10.345273Z"},"links":{"citing_paper":"/paper/2605.00273"},"observation_digest":"sha256:70a5afc13da964200fb1d87c8497313c07908a196cd19ab759adbb1722758c27","observation_id":"a875b08c-258b-465a-9c01-22c37e53e544","resolution":{"observed_at":"2026-07-06T13:32:34.138775Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-04T06:34:03.388597+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2605.00273","last_updated":"2026-06-08T16:33:25Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-02T14:38:38.045362Z","submitted_at":"2026-04-30T22:18:33Z","title":"When Do Diffusion Models learn to Generate Multiple Objects?"},"reference_resolution":{"displayed":42,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":2,"verified_exact":23,"verified_fuzzy":11},"total_outbound_references":42},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-04T06:34:03.388597+00:00","source":"crossref"},{"observed_at":"2026-08-04T06:33:57.428241+00:00","source":"retraction_watch"}],"thesis":"As of 5 August 2026, this Paper Citation Record lists 42 of 42 outbound references and 0 inbound Pith citation observations for arXiv:2605.00273."}