{"as_of":"2026-08-07T20:55:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:3bdcc484476206096c807c98ef2bcdc8fe8de0278a93d769cef7c2754ad45a29","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":8,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":8,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-07T06:34:17.273281+00:00","state":"measured"},{"denominator":8,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":8,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-07T14:21:35.617842Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-07-04T10:29:44.474408Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-08-07T14:21:35.617842Z","title":"Make it count: Text-to-image generation with an accurate number of objects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19166","last_updated":"2025-07-23T12:14:57Z","snapshot_observed_at":"2026-08-07T14:17:06.871504Z","submitted_at":"2025-05-25T14:32:24Z","title":"JEDI: The Force of Jensen-Shannon Divergence in Disentangling Diffusion Models","version":2},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-07T14:21:35.617842Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2505.19166"},"observation_digest":"sha256:a133e82280fd9f9b8f925ae2ee4896ee4f9400b177c11e8f82a755e4b1dd4698","observation_id":"eab8f185-3067-4344-978f-d534281a43ca","resolution":{"observed_at":"2026-08-07T14:21:35.617842Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-08-07T13:49:31.747748Z","title":"Make it count: Text- to-image generation with an accurate number of objects,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20935","last_updated":"2026-06-30T03:07:20Z","snapshot_observed_at":"2026-08-07T13:40:47.079903Z","submitted_at":"2025-05-27T09:23:10Z","title":"ISAC: Training-Free Instance-to-Semantic Attention Control for Multi-Instance Generation","version":4},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-07T13:49:31.747748Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2505.20935"},"observation_digest":"sha256:a9632138dcd47ae107db9097a7910cca7f12c27eceab6a0337db71a48e7307f6","observation_id":"6bf21faa-3598-4882-a330-84ce951debe6","resolution":{"observed_at":"2026-08-07T13:49:31.747748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-08-07T13:33:23.609326Z","title":"arXiv preprint arXiv:2406.10210 (2024)","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.21488","last_updated":"2025-05-27T17:54:24Z","snapshot_observed_at":"2026-08-07T13:24:37.065210Z","submitted_at":"2025-05-27T17:54:24Z","title":"Be Decisive: Noise-Induced Layouts for Multi-Subject Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-07T13:33:23.609326Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2505.21488"},"observation_digest":"sha256:bb78f8e152939a32fb3e4f18bffc7425e5eb8e985dffe2251b99172584122543","observation_id":"e945a66a-b59f-4c78-ad64-79c399363611","resolution":{"observed_at":"2026-08-07T13:33:23.609326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-08-07T11:54:17.996781Z","title":"Make it count: Text-to-image generation with an accurate number of objects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.01144","last_updated":"2025-06-04T07:45:25Z","snapshot_observed_at":"2026-08-07T11:48:12.548017Z","submitted_at":"2025-06-01T19:55:33Z","title":"FlowMo: Variance-Based Flow Guidance for Coherent Motion in Video Generation","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-07T11:54:17.996781Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2506.01144"},"observation_digest":"sha256:f499d212b06338c33434639e4866927f2da483391ffdeb3a0e603c39947075f0","observation_id":"0ea45198-da49-4e43-8899-98e48f061e84","resolution":{"observed_at":"2026-08-07T11:54:17.996781Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-08-06T21:48:51.348576Z","title":"Make it count: Text-to-image generation with an accurate number of objects","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.23418","last_updated":"2025-06-29T22:41:27Z","snapshot_observed_at":"2026-08-06T21:40:57.300580Z","submitted_at":"2025-06-29T22:41:27Z","title":"Why Settle for Mid: A Probabilistic Viewpoint to Spatial Relationship Alignment in Text-to-image Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-06T21:48:51.348576Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2506.23418"},"observation_digest":"sha256:dd56c9e8859de98ed52a6458b2affd2682b583901193250684e2facc86b5cf95","observation_id":"4fd1b3e2-497d-4ced-ae61-9af9773af035","resolution":{"observed_at":"2026-08-06T21:48:51.348576Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":"2406.10210","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-07-04T10:29:44.474408Z","title":"Make it count: Text-to-image generation with an accurate number of objects.arXiv preprint arXiv:2406.10210","venue":null,"work_id":"3b69b443-45f0-4bdd-b762-7d166511f0b8","year":2024},"citing_paper":{"arxiv_id":"2509.17458","last_updated":"2026-04-11T12:35:18Z","snapshot_observed_at":"2026-07-06T22:30:26.679189Z","submitted_at":"2025-09-22T07:51:28Z","title":"CARINOX: Inference-time Scaling with Category-Aware Reward-based Initial Noise Optimization and Exploration","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-18T15:25:39.116881Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2509.17458"},"observation_digest":"sha256:2819505e2c129d2ff163e32c611420310d1167efedc7fef908bc7ef9e71902b2","observation_id":"ffccaaf0-9307-464e-bea7-a9ab911bd3d4","resolution":{"observed_at":"2026-05-18T15:26:33.629698Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":"2406.10210","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-07-04T10:29:44.474408Z","title":"Make it count: Text-to-image generation with an accurate number of objects.arXiv preprint arXiv:2406.10210","venue":null,"work_id":"3b69b443-45f0-4bdd-b762-7d166511f0b8","year":2024},"citing_paper":{"arxiv_id":"2605.25763","last_updated":"2026-05-27T11:23:41Z","snapshot_observed_at":"2026-08-07T20:38:21.814755Z","submitted_at":"2026-05-25T12:17:32Z","title":"AI-T2I: Aggregating-and-Isolating Cross-Attention to Diffusion Models for Text-to-Image Synthesis","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-29T22:51:21.854892Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2605.25763"},"observation_digest":"sha256:e0a6ba664ba8ac26a72ee47bcb51502111d6307df3200f753110c1d664a11994","observation_id":"6fba4d7d-73f9-4c6e-8e1e-b1db4ad3c3cd","resolution":{"observed_at":"2026-06-29T22:54:00.953230Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects","version":1},"cited_work":{"arxiv_id":"2406.10210","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2406.10210","snapshot_observed_at":"2026-07-04T10:29:44.474408Z","title":"Make it count: Text-to-image generation with an accurate number of objects.arXiv preprint arXiv:2406.10210","venue":null,"work_id":"3b69b443-45f0-4bdd-b762-7d166511f0b8","year":2024},"citing_paper":{"arxiv_id":"2606.23835","last_updated":"2026-06-22T18:16:31Z","snapshot_observed_at":"2026-08-02T20:20:51.254879Z","submitted_at":"2026-06-22T18:16:31Z","title":"ABACUS: Adapting Unified Foundation Model for Bridging Image Count Understanding and Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-26T08:52:23.547337Z"},"links":{"cited_paper":"/paper/2406.10210","citing_paper":"/paper/2606.23835"},"observation_digest":"sha256:b787cb6997e7b655774a7cfc10af1370f3e8a988efe84c551a6a2734a574d344","observation_id":"188e9d84-4753-4694-b6b4-7168abcd87d6","resolution":{"observed_at":"2026-07-04T10:29:44.476019Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-07T06:34:17.273281+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2406.10210/citation-record","integrity":"/paper/2406.10210/integrity","json":"/paper/2406.10210/citation-record.json","paper":"/paper/2406.10210"},"outbound":[],"paper":{"arxiv_id":"2406.10210","last_updated":"2024-06-14T17:46:08Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-06T18:31:08.584682Z","submitted_at":"2024-06-14T17:46:08Z","title":"Make It Count: Text-to-Image Generation with an Accurate Number of Objects"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-07T06:34:17.273281+00:00","source":"crossref"},{"observed_at":"2026-08-07T06:34:11.927384+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 8 inbound Pith citation observations for arXiv:2406.10210."}