{"as_of":"2026-08-16T02:26:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:48e8dc054fd36dd7db7ef30dfabed4f835cd9256c010d59a1c73294fb0f06d71","coverage":[{"denominator":38,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":38,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T23:34:49.638653Z","state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-15T06:32:42.880941+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T19:17:19.634242Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.04347","snapshot_observed_at":"2026-07-11T19:17:19.634242Z","title":"arXiv preprint arXiv:2505.04347 (2025)","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.04423","last_updated":"2026-07-07T07:27:22Z","snapshot_observed_at":"2026-08-04T06:57:07.480777Z","submitted_at":"2026-07-05T17:33:59Z","title":"Transferability Between Understanding and Generation in Unified Multimodal Models","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-07-11T19:17:19.634242Z"},"links":{"cited_paper":"/paper/2505.04347","citing_paper":"/paper/2607.04423"},"observation_digest":"sha256:d30d12af3122279c269cf69f1a58804db446fa743aa07f83d850560712baa230","observation_id":"4a0bf9cf-6974-4ea1-97d6-cf4406cf7544","resolution":{"observed_at":"2026-07-11T19:17:19.634242Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2505.04347/citation-record","integrity":"/paper/2505.04347/integrity","json":"/paper/2505.04347/citation-record.json","paper":"/paper/2505.04347"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2307.01952","last_updated":"2023-07-04T23:04:57Z","snapshot_observed_at":"2026-08-14T22:54:08.184266Z","submitted_at":"2023-07-04T23:04:57Z","title":"SDXL: Improving Latent Diffusion Models for High-Resolution Image Synthesis","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.01952","snapshot_observed_at":"2026-08-15T23:34:49.456894Z","title":"Sdxl: Improving latent diffusion models for high-resolution image synthesis,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.456894Z"},"links":{"cited_paper":"/paper/2307.01952","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:aadeec91c287d526b6ce7a9b29716727cf309629b4881ba064c88af39b394290","observation_id":"4145f01c-9bbc-4820-9dfd-360182efb716","resolution":{"observed_at":"2026-08-15T23:34:49.456894Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.194779Z","title":"Midjourney,","venue":null,"work_id":"88e24992-6007-4e92-85d1-1998ed9b9147","year":2022},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.463562Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:a6a12a6ab743d7daed0e7dc9470c9a80624ef254ac9cab232a62b2a630def7eb","observation_id":"e05bc6a4-b9ec-4f7c-b7d4-dceaf9e64b83","resolution":{"observed_at":"2026-08-15T23:34:50.199187Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.181021Z","title":"Dall-e: Creating images from text,","venue":null,"work_id":"4b96e63c-c141-4f97-9e59-d1e71fd5bdec","year":2021},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.468377Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:9b35abbf0669d6c280eb48216e15b27429b0c27ee3d144ee5bf945081b934d8f","observation_id":"e8c2edc8-54c6-4271-be29-5b5ba9d15bfb","resolution":{"observed_at":"2026-08-15T23:34:50.185116Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.166437Z","title":null,"venue":null,"work_id":"f36a2850-9764-41b7-8a12-d40fd581a2d2","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.472689Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:e8552e83148d9a6bf427d790cbf00da976906c1533e00ad4db48140053ded0fe","observation_id":"c27bf65b-3b18-4f27-b68c-4ff56a74b6d3","resolution":{"observed_at":"2026-08-15T23:34:50.171380Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.152565Z","title":"Photorealistic text-to-image diffusion models with deep language understanding,","venue":null,"work_id":"41e430b4-6c8a-445e-b2ae-d57de03ed2c1","year":2022},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.477036Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:b08d3760b4a31aeefecaa27d420e3a1e4d6c897ad5a6e9c2408546b914b55271","observation_id":"7725f788-46c3-4ba5-9b80-88dd401393ff","resolution":{"observed_at":"2026-08-15T23:34:50.158200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.138010Z","title":"Ranni: Taming text-to-image diffusion for accurate instruction following,","venue":null,"work_id":"cafa77c8-73a9-46c2-a3e4-5b58cc6fdccd","year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.481759Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:0c273e52e20ff2d939b744d574ff0f2c76b5a0edfcad9f265dfd1f7432515601","observation_id":"6fd5c28a-0b34-40b4-9bc9-89d5c7340dce","resolution":{"observed_at":"2026-08-15T23:34:50.143031Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.124906Z","title":"Scenecomposer: Any-level semantic image synthesis,","venue":null,"work_id":"f731db80-6d22-4ecf-bf4f-87ebee89ab78","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.486351Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:bd02fe406dec7b30af715a2da83a3213d64023d91637636794b6646a22ff7803","observation_id":"ffc1831e-f0e3-4e35-bf10-641ee1f422ea","resolution":{"observed_at":"2026-08-15T23:34:50.129583Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.490509Z","title":"Dense text-to-image generation with attention modulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.490509Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:637ef3e7bc2481c2f17e1d4985bdd6ba62caab94200d7539bdca4a9e669c3d8e","observation_id":"c9fb6e4a-0dd7-48ea-957b-e240f2988ad8","resolution":{"observed_at":"2026-08-15T23:34:49.490509Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.099444Z","title":"Boxdiff: Text-to-image synthesis with training-free box-constrained diffusion,","venue":null,"work_id":"a496c9e8-cffe-45cc-a44a-e53ec2324a80","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.495759Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:cccbc9454d509157b7f1b708c2cc2fa556563654e230fd9565a824dce226feea","observation_id":"e570dea4-82a6-4cd4-b7f8-379fc5064c97","resolution":{"observed_at":"2026-08-15T23:34:50.103877Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.084882Z","title":"Layoutllm-t2i: Eliciting layout guidance from llm for text-to-image generation,","venue":null,"work_id":"cbdbb58a-dae2-4541-8d29-41c3ded0575e","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.501632Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:f07b8d372265e1ca13dc0c6e85b1548d92f35444ba8c43d264782331dc28a8c0","observation_id":"08dabad3-ee7e-469c-9c0d-286bc80078e7","resolution":{"observed_at":"2026-08-15T23:34:50.090030Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2402.03290","last_updated":"2024-02-05T18:49:17Z","snapshot_observed_at":"2026-08-13T04:25:49.508104Z","submitted_at":"2024-02-05T18:49:17Z","title":"InstanceDiffusion: Instance-level Control for Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.03290","snapshot_observed_at":"2026-08-15T23:34:49.506636Z","title":"Instancediffusion: Instance-level control for image generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.506636Z"},"links":{"cited_paper":"/paper/2402.03290","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:93a65954158e6357c968558c94712719c7c9934c5b74a6cbcb2a50151211d891","observation_id":"84e9e039-4a30-41d0-a4b8-60eb03f2ac1c","resolution":{"observed_at":"2026-08-15T23:34:49.506636Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.072237Z","title":"Adding conditional control to text-to-image diffusion models,","venue":null,"work_id":"15496cfd-170f-445f-807b-6dd65d6d2692","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.510898Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:5f1d0987d00ebea00bfb502d3a7060775e8b717fe1c07de71c49ec309cb8fbb9","observation_id":"18303534-186e-4068-a9e0-47fbdb27801f","resolution":{"observed_at":"2026-08-15T23:34:50.076127Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.02236","last_updated":"2023-06-04T02:33:12Z","snapshot_observed_at":"2026-08-14T01:47:21.381454Z","submitted_at":"2023-06-04T02:33:12Z","title":"Detector Guidance for Multi-Object Text-to-Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.02236","snapshot_observed_at":"2026-08-15T23:34:49.514493Z","title":"Detector guidance for multi-object text-to-image generation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.514493Z"},"links":{"cited_paper":"/paper/2306.02236","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:dc8034be8d0f26d54a03ef222a2a6cceac9ab1a49878430c31269a39d1ccde97","observation_id":"8d6e6530-cfee-4ef3-a0fa-4a03b2d84996","resolution":{"observed_at":"2026-08-15T23:34:49.514493Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.059436Z","title":"Adver- sarial supervision makes layout-to-image diffusion models thrive,","venue":null,"work_id":"5a0d96f2-422e-4d4d-968c-adc15f59ac14","year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.519704Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:c8112bdf6dca44ae0a66ae973f7ea71b173679b82ee60322d3f27df8b61cac85","observation_id":"93c59ef0-0131-412c-8038-b93fbc616166","resolution":{"observed_at":"2026-08-15T23:34:50.063918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.047111Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks,","venue":null,"work_id":"d7df97a7-9418-4fdc-ab09-1be312124c62","year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.524371Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:4e6eb47462d8c9aff00a7f609eb99c7ef2e332f389699b51b25374e16ed913a9","observation_id":"6723baa8-a5df-4781-9d06-ab62a4ad985b","resolution":{"observed_at":"2026-08-15T23:34:50.051675Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.528196Z","title":"Denoising diffusion prob- abilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.528196Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:b006657839793422bb5a0de2a096372bf0459c5b468f9e284ba1207079ff2963","observation_id":"916f5dd8-df16-49e9-b172-051130abaec6","resolution":{"observed_at":"2026-08-15T23:34:49.528196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.534871Z","title":"High-resolution image synthesis with latent diffu- sion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.534871Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:431ed8f60548cdc67d650d33043c632f7e102bf48ec17a8621705f5a0c5b93c4","observation_id":"0ba393e3-15c2-4216-a76d-26752235c282","resolution":{"observed_at":"2026-08-15T23:34:49.534871Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.02938","last_updated":"2021-09-15T04:03:34Z","snapshot_observed_at":"2026-08-13T18:33:10.202093Z","submitted_at":"2021-08-06T04:43:13Z","title":"ILVR: Conditioning Method for Denoising Diffusion Probabilistic Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.02938","snapshot_observed_at":"2026-08-15T23:34:49.542272Z","title":"Ilvr: Conditioning method for denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.542272Z"},"links":{"cited_paper":"/paper/2108.02938","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:cc9a42f109cfcdc21614d274c238f4a5e1b0bb595f366d5d1760319925ee2752","observation_id":"1a22c75f-156b-4746-9f7b-f05e03f0b2eb","resolution":{"observed_at":"2026-08-15T23:34:49.542272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.547587Z","title":"Diffusion models beat gans on image synthesis,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.547587Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:19914ed376f5ce75c4c86e2f9a1a1aa2ba905d5036a869e6e58cae14b519e784","observation_id":"fede20ef-04fe-45cf-a1a1-2111c017be9f","resolution":{"observed_at":"2026-08-15T23:34:49.547587Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-14T03:40:56.071989Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-15T23:34:49.552444Z","title":"Sdedit: Image synthesis and editing with stochastic differential equations,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.552444Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:b2755d4e7915e351f476fab7631d81974cc5db0519d52e7885d4f501cea7b69a","observation_id":"2d8022e9-ad05-4a36-8bbd-dbe244ae0228","resolution":{"observed_at":"2026-08-15T23:34:49.552444Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.556576Z","title":"Deep unsupervised learning using nonequilibrium thermody- namics,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.556576Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:48bde0966f5be6f8fe41fdd396db7dd333b8c6c36071faeff83db1165e4ccf15","observation_id":"21ed3ec9-0a56-40e4-ac07-8b7315a23179","resolution":{"observed_at":"2026-08-15T23:34:49.556576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:50.002246Z","title":"Modelscope text-to-video technical report,","venue":null,"work_id":"455b5680-75af-4f1f-93f3-4e0203bef7b7","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.561178Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:32b0f41f978d85840013991561a5532e6e68213464cfb5ef09ec334e755acc0d","observation_id":"e7665c01-b9be-41a5-84ad-6c74b0077265","resolution":{"observed_at":"2026-08-15T23:34:50.006383Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.989858Z","title":"Magictime: Time-lapse video generation models as metamorphic simulators,","venue":null,"work_id":"323f3329-4123-47ba-a867-4e142097dc6c","year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.566223Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:b8761e574c8a2dbc4f245630224f4a645b1dcc6b5db0bfb97f5c24c8b72a147c","observation_id":"54a089f0-818a-4020-b419-12d0c6d46456","resolution":{"observed_at":"2026-08-15T23:34:49.993881Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.977488Z","title":"Champ: Controllable and consistent human image animation with 3d parametric guidance,","venue":null,"work_id":"0e0d5ef6-ea68-4d70-b531-99a0f3652e56","year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.570538Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:62c8c4781b9864e5579961654f96f829b116e1a1b513040ea4e16bbb14042f23","observation_id":"a68c36cf-fdce-4825-926d-e267396a2faf","resolution":{"observed_at":"2026-08-15T23:34:49.981914Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.964564Z","title":"Renderdiffusion: Image diffusion for 3d reconstruction, inpainting and generation,","venue":null,"work_id":"7889075a-3eef-4545-96e8-e90798ac3de4","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.579029Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:0729cfa702ee0e1db5ce39e8ed5e87c16d95556a13eff037d25e53ab8420c749","observation_id":"10a15bf3-4321-4554-b0a8-30db7947d738","resolution":{"observed_at":"2026-08-15T23:34:49.969200Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2306.17843","last_updated":"2023-07-23T21:27:30Z","snapshot_observed_at":"2026-08-15T21:09:20.463504Z","submitted_at":"2023-06-30T17:59:08Z","title":"Magic123: One Image to High-Quality 3D Object Generation Using Both 2D and 3D Diffusion Priors","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.17843","snapshot_observed_at":"2026-08-15T23:34:49.584217Z","title":"Magic123: One image to high-quality 3d object generation using both 2d and 3d diffusion priors,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.584217Z"},"links":{"cited_paper":"/paper/2306.17843","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:9e65fd37a72eb6095dc1d44158796d4a171b67f74fe621267941d6e4685fa77a","observation_id":"54971bf6-857a-4dab-9d6e-47187e1d5896","resolution":{"observed_at":"2026-08-15T23:34:49.584217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.948961Z","title":"Generative adversarial text to image synthesis,","venue":null,"work_id":"7b6a9d70-b988-4e39-ac6e-f70c96717843","year":2016},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.589320Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:0ad49e9f54a14c053009e3c01fdd53e06360aab22ab9d8b9859e2e5876568bb9","observation_id":"59e6cd46-290b-4d87-aa74-f1fa42c239a8","resolution":{"observed_at":"2026-08-15T23:34:49.953963Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.933690Z","title":"Learning what and where to draw,","venue":null,"work_id":"82cd2b7e-3f41-4e65-848d-a72789310b59","year":2016},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.594418Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:d8023cf58a8fdf3c7ad2f622b0d1a795bab3adc100c8b71602c7ba52cd4ce568","observation_id":"6794cd72-9dc2-4422-ab7e-0ae492f07ca7","resolution":{"observed_at":"2026-08-15T23:34:49.938990Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.918532Z","title":"More control for free! image synthesis with semantic diffusion guidance,","venue":null,"work_id":"9d63d0d6-c2df-438d-a634-f5ab24d1e308","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.598726Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:2700dce65f8f41f1e70161f06fea11bc19964438b86a3ed2a758e1e938f083c8","observation_id":"99fcc02b-c39d-48b8-bb5a-9d7d51a4c3f3","resolution":{"observed_at":"2026-08-15T23:34:49.922934Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-08-14T06:37:15.299690Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-15T23:34:49.603495Z","title":"Classifier-free diffusion guidance,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.603495Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:8bcdb83d8e89fa5f74250a74f106f700c1864695f41a18b1bd229a5c0c07c1e3","observation_id":"f9bde8c2-961e-4a71-97e5-4785454e9a4c","resolution":{"observed_at":"2026-08-15T23:34:49.603495Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.903827Z","title":"Universal guidance for diffusion models,","venue":null,"work_id":"a1c44511-835c-476f-84b7-5e24643e8ccf","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.607733Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:7d49de5f42b047cfd61790ff52fd72096a68c2421ec43107a820d7f83704fbf3","observation_id":"066dd14a-411d-4662-a245-81dc84285ff7","resolution":{"observed_at":"2026-08-15T23:34:49.908918Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.889102Z","title":"Inversion-based style transfer with diffusion models,","venue":null,"work_id":"9fe0754a-b664-44dc-8f79-329b0717a4f8","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.611759Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:7b992d55d04c3f1fc15c8d815828ed6b8f49916296ad918cc6eb6dd0616a8410","observation_id":"002b2295-fb98-4f8d-9bad-3ab304d1a9c2","resolution":{"observed_at":"2026-08-15T23:34:49.894032Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-15T23:34:49.615908Z","title":"Prompt-to-prompt image editing with cross attention control,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.615908Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:86e974b3a0f3cc96a20e4a98e7db2b9ff12aad3a7a756bb252542e735b5cb221","observation_id":"a257889d-918d-4509-9b11-e4da488fc5bb","resolution":{"observed_at":"2026-08-15T23:34:49.615908Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-08-14T04:52:02.922671Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-08-15T23:34:49.620099Z","title":"Make it count: Text-to-image generation with an accurate number of objects,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.620099Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:bb0ac4119e727ea261c661bdac64d5a7726857ace74169d8c1f045c2a9d45c47","observation_id":"9a849933-5def-4fc9-af78-cbfbc2848ac4","resolution":{"observed_at":"2026-08-15T23:34:49.620099Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.04692","last_updated":"2024-03-17T16:59:25Z","snapshot_observed_at":"2026-08-13T00:59:54.489440Z","submitted_at":"2024-03-07T17:41:37Z","title":"PixArt-\\Sigma: Weak-to-Strong Training of Diffusion Transformer for 4K Text-to-Image Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.04692","snapshot_observed_at":"2026-08-15T23:34:49.624612Z","title":"Pixart- \\sigma: Weak-to-strong training of diffusion transformer for 4k text-to- image generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.624612Z"},"links":{"cited_paper":"/paper/2403.04692","citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:bcdc0fec06f3e848fcebf967b784d447310fd90c4c9f4b863ac03009c772b9fc","observation_id":"9fc1efae-4205-463d-ba9c-26e96039385c","resolution":{"observed_at":"2026-08-15T23:34:49.624612Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.629619Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.629619Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:27858813ad691f494a5dc2c9e9abedd9dfd34925047534471705e5fcee20a625","observation_id":"5174fd18-1543-4b42-bb95-181394f0a034","resolution":{"observed_at":"2026-08-15T23:34:49.629619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.866601Z","title":"clip-vit-large-patch14,","venue":null,"work_id":"46537bc6-021a-469c-8025-ab11dcd5e0b8","year":2021},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.633873Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:28fbdb06eb4a91443137ccc5674316a4efc4ca4c4af9d1b80e73497007fc755f","observation_id":"356c2531-29c8-42ee-82c3-ce24238e2de4","resolution":{"observed_at":"2026-08-15T23:34:49.872079Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T23:34:49.845986Z","title":"Imagereward: Learning and evaluating human preferences for text-to-image generation,","venue":null,"work_id":"69122051-8dc2-4392-8783-9c1f9be910f1","year":2023},"citing_paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-15T23:34:49.638653Z"},"links":{"citing_paper":"/paper/2505.04347"},"observation_digest":"sha256:ce505330c1cdaf87c8a7395ecbe3291c897bb69a48ade0e337aaeee592055b1a","observation_id":"7e9d78b6-d045-4fbf-bd9c-2d5aae6f7a65","resolution":{"observed_at":"2026-08-15T23:34:49.854133Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-15T06:32:42.880941+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2505.04347","last_updated":"2025-05-07T11:47:35Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-15T23:29:02.843243Z","submitted_at":"2025-05-07T11:47:35Z","title":"CountDiffusion: Text-to-Image Synthesis with Training-Free Counting-Guidance Diffusion"},"reference_resolution":{"displayed":38,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":17,"verified_exact":0,"verified_fuzzy":21},"total_outbound_references":38},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-15T06:32:42.880941+00:00","source":"crossref"},{"observed_at":"2026-08-15T06:32:39.529945+00:00","source":"retraction_watch"}],"thesis":"As of 16 August 2026, this Paper Citation Record lists 38 of 38 outbound references and 1 inbound Pith citation observation for arXiv:2505.04347."}