{"as_of":"2026-08-07T04:46:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:e03d4b120ca0876ab0bdc1bbd3c870a24978e98816577b6f0d4e987295be6668","coverage":[{"denominator":96,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":96,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-06T11:12:26.637584Z","state":"measured"},{"denominator":96,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":96,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2507.23058/citation-record","integrity":"/paper/2507.23058/integrity","json":"/paper/2507.23058/citation-record.json","paper":"/paper/2507.23058"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:25.952804Z","title":"Cognitive neuroscience of human counterfactual reasoning,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:25.952804Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:4325619349538805b96852b7f93148bb5fa5297fb5837f0456aafa114e6a8ace","observation_id":"f0d36c8f-b4fc-4d38-b266-05988e4efbfc","resolution":{"observed_at":"2026-08-06T11:12:25.952804Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.076398Z","title":"Mental models and counterfactual thoughts about what might have been,","venue":null,"work_id":null,"year":2002},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.076398Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:fe783e89b005432f400dff8cd01c1d07b0555ad17332489556cedf6eba6b5f93","observation_id":"58ef9d79-3000-40fa-bc29-2b1299a4ea35","resolution":{"observed_at":"2026-08-06T11:12:26.076398Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.175561Z","title":"Useful counterfactuals,","venue":null,"work_id":null,"year":1999},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.175561Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:3c10cb24b9415db0929f726bc9d6f8cd61e35f10fa73cf1f51dd75f96fb3b03e","observation_id":"6011ce36-c271-42c7-b81b-c7e437dc73a9","resolution":{"observed_at":"2026-08-06T11:12:26.175561Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1312.6114","last_updated":"2022-12-10T21:04:00Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2013-12-20T20:58:10Z","title":"Auto-Encoding Variational Bayes","version":11},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1312.6114","snapshot_observed_at":"2026-08-06T11:12:26.249434Z","title":"Auto-encoding variational bayes,","venue":null,"work_id":null,"year":2013},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.249434Z"},"links":{"cited_paper":"/paper/1312.6114","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:845c61649a746908fd41126aa1379a46ccd0ce126e9eebaca1e42b85f97b64a9","observation_id":"5e14c3fd-9034-4c7b-84a7-c6eb48e5de5b","resolution":{"observed_at":"2026-08-06T11:12:26.249434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.268381Z","title":"V ariational inference: A review for statisticians,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.268381Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:419dc61a6180fcf1faa0aaab00d76ed1f8db9e62d9b5843fc7de9ea53055d968","observation_id":"1173bdc6-ad6e-46b8-ae26-6c4eb08dcfa2","resolution":{"observed_at":"2026-08-06T11:12:26.268381Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.273484Z","title":"Denoising diffusion probabilistic models,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.273484Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:856d655a15a3bdf627eab31f563692afc3e1b35aafb81bcbb84495da07d4472b","observation_id":"c9364d29-0f7b-47ea-9921-962852e631dd","resolution":{"observed_at":"2026-08-06T11:12:26.273484Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.278282Z","title":"Diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.278282Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:1dabc1ddf7aa5aea0db06416455be6163dc0132b0b0138872e42c5b35a673d91","observation_id":"132f047f-35b9-4d84-bbd3-e606599f9d32","resolution":{"observed_at":"2026-08-06T11:12:26.278282Z","resolver_source":null,"status":"malformed_identifier"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2010.02502","last_updated":"2022-10-05T20:19:21Z","snapshot_observed_at":"2026-07-06T10:01:50.133383Z","submitted_at":"2020-10-06T06:15:51Z","title":"Denoising Diffusion Implicit Models","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.02502","snapshot_observed_at":"2026-08-06T11:12:26.282220Z","title":"Denoising diffusion implicit models,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.282220Z"},"links":{"cited_paper":"/paper/2010.02502","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:3c0594dc660012ed4326f6a87ee0a4aac759492f2b936bcf0e0ad056a886c469","observation_id":"a2c6d79d-8578-4039-b4fc-6b50401d783b","resolution":{"observed_at":"2026-08-06T11:12:26.282220Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.286723Z","title":"High-resolution image synthesis with latent diffusion models,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.286723Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ca25083c3646cfb05aa5d70f18cfa6ce63e57cb455bb3931b4785aa10382554e","observation_id":"42ca666a-ac4c-478a-9ff2-93f516dc2736","resolution":{"observed_at":"2026-08-06T11:12:26.286723Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.290796Z","title":"U-net: Convolutional networks for biomedical image segmentation,","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.290796Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:7c4565c8d25fa6bdd6b8cad8da037e4f54279b74dc71620f15df9b9fa85007a0","observation_id":"459828b8-9d79-4f54-800b-4d21c66a666f","resolution":{"observed_at":"2026-08-06T11:12:26.290796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.294905Z","title":"Attention is all you need,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.294905Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:711b34c534c1c66ea81e53e4ebc3dc509ff39ba820233ab3b16336fbc84146e4","observation_id":"05012135-609c-4070-93e3-c3782955f4b8","resolution":{"observed_at":"2026-08-06T11:12:26.294905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.299151Z","title":"Adding conditional control to text-to-image diffusion mod- els,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.299151Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:1ef624df615860b5ecda7f6272e1e80503e1164c5fc0739635f75e6164ecc7f7","observation_id":"d81e5e83-2a50-4c3c-be1e-c53d6a671560","resolution":{"observed_at":"2026-08-06T11:12:26.299151Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.303356Z","title":"Paint by example: Exemplar-based image editing with diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.303356Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b797a0ea82d625c35eb78b90e511ff08d4335176d13a55ea5de34f80b0c495ab","observation_id":"d9a716b6-becb-4296-a2b5-1074bc3cce44","resolution":{"observed_at":"2026-08-06T11:12:26.303356Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.307384Z","title":"Mobi: Multimodal object inpainting using diffusion models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.307384Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:865448e7b6ede5cb43272575928c360edfe52ea374f6f140efcdd8e2e8f26033","observation_id":"7448efe1-6627-4c40-b703-991acfd80501","resolution":{"observed_at":"2026-08-06T11:12:26.307384Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.311362Z","title":"Challenges in autonomous vehicle testing and validation,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.311362Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:71baba33731b97a985f3ce38183829b8ce3f20bbf17eb97c787ac931450dfa7a","observation_id":"4e1e0fdd-e695-4894-a4f8-f915881a5d40","resolution":{"observed_at":"2026-08-06T11:12:26.311362Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2307.09481","last_updated":"2024-05-08T03:21:34Z","snapshot_observed_at":"2026-07-06T15:55:28.974661Z","submitted_at":"2023-07-18T17:59:02Z","title":"AnyDoor: Zero-shot Object-level Image Customization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2307.09481","snapshot_observed_at":"2026-08-06T11:12:26.315287Z","title":"Anydoor: Zero-shot object-level image customization,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.315287Z"},"links":{"cited_paper":"/paper/2307.09481","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:6c259815ee562d9ba5d213cad347ef9481b19b3e46097fe055ba08a4a53901ad","observation_id":"7af4da9b-6bfc-4158-bd19-62dd13255402","resolution":{"observed_at":"2026-08-06T11:12:26.315287Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.02489","last_updated":"2024-07-02T17:59:50Z","snapshot_observed_at":"2026-07-06T18:40:27.299063Z","submitted_at":"2024-07-02T17:59:50Z","title":"Magic Insert: Style-Aware Drag-and-Drop","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.02489","snapshot_observed_at":"2026-08-06T11:12:26.319799Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.319799Z"},"links":{"cited_paper":"/paper/2407.02489","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:15689efb58f792ad2b1fc64e4453021484adecfa7c0f0a79dc9d3ce55a8aa87e","observation_id":"5922b2a4-342e-4bfa-8d1f-39c288db6ded","resolution":{"observed_at":"2026-08-06T11:12:26.319799Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.14406","last_updated":"2023-04-27T17:59:58Z","snapshot_observed_at":"2026-08-01T13:30:34.234912Z","submitted_at":"2023-04-27T17:59:58Z","title":"Putting People in Their Place: Affordance-Aware Human Insertion into Scenes","version":1},"cited_work":{"arxiv_id":"2304.14406","doi":null,"metadata_source":"pith","pith_arxiv_id":"2304.14406","snapshot_observed_at":"2026-08-06T11:12:27.386781Z","title":"Putting People in Their Place: Affordance-Aware Human Insertion into Scenes","venue":"cs.CV","work_id":"2895f405-43ce-49d5-b0c5-032ce6806e94","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.324468Z"},"links":{"cited_paper":"/paper/2304.14406","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:52550c01f452f43ec449494d30840361ff49b02cb2f94257b605a70114d50003","observation_id":"a1948f14-8ec2-4bf1-a86b-387335ecfef8","resolution":{"observed_at":"2026-08-06T11:12:27.391303Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01447","last_updated":"2023-11-02T17:56:59Z","snapshot_observed_at":"2026-07-06T16:42:19.938941Z","submitted_at":"2023-11-02T17:56:59Z","title":"CADSim: Robust and Scalable in-the-wild 3D Reconstruction for Controllable Sensor Simulation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01447","snapshot_observed_at":"2026-08-06T11:12:26.328559Z","title":"Cadsim: Robust and scalable in-the-wild 3d reconstruc- tion for controllable sensor simulation,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.328559Z"},"links":{"cited_paper":"/paper/2311.01447","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:e3b2e208746ec58ab8a355733c3d141a223051a8a728fb140ab854b44dfa532d","observation_id":"9a7c9139-a823-44bd-a296-5ac09271b015","resolution":{"observed_at":"2026-08-06T11:12:26.328559Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.11573","last_updated":"2024-03-20T01:13:48Z","snapshot_observed_at":"2026-07-06T17:46:07.974611Z","submitted_at":"2024-03-18T08:50:04Z","title":"Just Add $100 More: Augmenting NeRF-based Pseudo-LiDAR Point Cloud for Resolving Class-imbalance Problem","version":2},"cited_work":{"arxiv_id":"2403.11573","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.11573","snapshot_observed_at":"2026-08-06T11:12:27.351351Z","title":"Just Add $100 More: Augmenting NeRF-based Pseudo-LiDAR Point Cloud for Resolving Class-imbalance Problem","venue":"cs.CV","work_id":"f5fa2d62-0d8a-4ec7-bf40-9936658a9182","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.333331Z"},"links":{"cited_paper":"/paper/2403.11573","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:d484f49f26c59772ad1050285af9e64dffa2f9cc5bb51471cb3ae62fe8b4c979","observation_id":"228664f1-99e6-4d9d-8977-9a54d8f37de9","resolution":{"observed_at":"2026-08-06T11:12:27.355989Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.12419","last_updated":"2025-05-01T12:58:23Z","snapshot_observed_at":"2026-08-04T05:13:41.215009Z","submitted_at":"2023-12-19T18:50:33Z","title":"Scene-Conditional 3D Object Stylization and Composition","version":2},"cited_work":{"arxiv_id":"2312.12419","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.12419","snapshot_observed_at":"2026-08-06T11:12:27.330771Z","title":"Scene-Conditional 3D Object Stylization and Composition","venue":"cs.CV","work_id":"41715d31-7e6d-4469-8bf3-f4ee93aef8e1","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.337912Z"},"links":{"cited_paper":"/paper/2312.12419","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:85de15b5326a770b0427ee483edecdad3ac000d329f56a20e991c4cd15cf768f","observation_id":"db1e9758-cc22-4aa6-8f9a-f3fbacde59ba","resolution":{"observed_at":"2026-08-06T11:12:27.335283Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.342312Z","title":"Editable scene simulation for autonomous driving via collaborative llm-agents,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.342312Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:4bca57f27ec4c9fc6325e5cfdf4a7301b9feb92275d6b8213f76fa1a8d0d5a15","observation_id":"559b2057-ec8c-4282-a5c0-0e913c5dbdc2","resolution":{"observed_at":"2026-08-06T11:12:26.342312Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.346306Z","title":"Geosim: Realistic video simulation via geometry-aware com- position for self-driving,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.346306Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:8c607712cef0a323903482b949ccec7b204dc1b54c3f667da989011346945279","observation_id":"5a5db670-2e25-4909-9c2e-0b290b0eea1a","resolution":{"observed_at":"2026-08-06T11:12:26.346306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.14494","last_updated":"2024-12-19T03:39:13Z","snapshot_observed_at":"2026-08-03T19:49:51.734518Z","submitted_at":"2024-12-19T03:39:13Z","title":"Drive-1-to-3: Enriching Diffusion Priors for Novel View Synthesis of Real Vehicles","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.14494","snapshot_observed_at":"2026-08-06T11:12:26.350171Z","title":"Drive-1-to-3: Enriching diffusion priors for novel view synthesis of real vehicles,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.350171Z"},"links":{"cited_paper":"/paper/2412.14494","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:6c822e55e170d447d93dd20b2390c1632a9fae547f8b5aed2081a179ba6688af","observation_id":"2eea4b1e-9794-4cac-95ab-09cf3f28280a","resolution":{"observed_at":"2026-08-06T11:12:26.350171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.354700Z","title":"Multitest: Physical-aware object insertion for testing multi-sensor fusion perception systems,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.354700Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b61f95abddd256a810ca42da6e2ea7c54b28ea649180d63d029dfb331a7c2b86","observation_id":"9f3bbb6c-5b56-4fe0-9995-c55cfa8f4cb1","resolution":{"observed_at":"2026-08-06T11:12:26.354700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.358886Z","title":"Lift3d: Synthesize 3d training data by lifting 2d gan to 3d generative radiance field,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.358886Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ea4e88b27a59ad13efc711d34f670525cbd21279c1c36e9479fd7f2eb838a594","observation_id":"625f83a2-6a94-4094-9881-e2a93cd6bdc3","resolution":{"observed_at":"2026-08-06T11:12:26.358886Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.362945Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.362945Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:767f4ea88415630ae2a51cf01581bffda8fbf3cf1f79d093935ee2f7872ecf7e","observation_id":"24e32757-cf36-43b4-837c-c17fbd85bba3","resolution":{"observed_at":"2026-08-06T11:12:26.362945Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:28.018789Z","title":"Neurad: Neural rendering for autonomous driving,","venue":null,"work_id":"cccbc7f1-dc13-47c0-a7d8-66a5d81eaaec","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.366618Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:0ce566ca77a484a312a89e658485bf93775034273faf966624e82045e34d1281","observation_id":"7ea0bbac-69c6-4328-828d-510373633fed","resolution":{"observed_at":"2026-08-06T11:12:28.023268Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:28.005203Z","title":"Unisim: A neural closed-loop sensor simulator,","venue":null,"work_id":"bf50af48-73f5-40dd-a890-dde8ababb4ca","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.370626Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:2fb550ca9355f350e549f449e796c85e7b98c255680527035dbc18dadda0dbe6","observation_id":"79a220d3-6c64-40ef-aa6d-75c60e29fb17","resolution":{"observed_at":"2026-08-06T11:12:28.009411Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.991360Z","title":"Diffusion models are geometry critics: Single image 3d editing using pre-trained diffusion priors,","venue":null,"work_id":"782a878a-136a-4a5e-8157-b998f8de80c7","year":2025},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.374364Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:62d99471036e525aaf0e1aef0f5ccb9fd6f586d4aba9f74692324a5bb702be6c","observation_id":"b7c2c19d-20a9-429d-8108-9515bfbb03f3","resolution":{"observed_at":"2026-08-06T11:12:27.996089Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2406.09292","last_updated":"2024-10-28T23:42:11Z","snapshot_observed_at":"2026-08-06T23:25:25.085388Z","submitted_at":"2024-06-13T16:29:18Z","title":"Neural Assets: 3D-Aware Multi-Object Scene Synthesis with Image Diffusion Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.09292","snapshot_observed_at":"2026-08-06T11:12:26.378264Z","title":"Neural assets: 3d-aware multi-object scene synthesis with image diffusion models,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.378264Z"},"links":{"cited_paper":"/paper/2406.09292","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:bebbba2e8e7728af48473ad752503c6556ce62213970a1475acfa0d4b7a106c1","observation_id":"2579120d-f968-4c9c-b662-4e3a319cc76d","resolution":{"observed_at":"2026-08-06T11:12:26.378264Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.978286Z","title":"Image sculpting: Precise object editing with 3d geometry control,","venue":null,"work_id":"468c6faf-f312-4ca9-b87e-242850cf733c","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.382512Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:c0b5aaf8dfe1c837d6e656d8e3ad8491ab4ca31c65050c11013d961e3f6753ee","observation_id":"50c99053-bd4e-4424-ae27-2bc61f496b46","resolution":{"observed_at":"2026-08-06T11:12:27.982419Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.964150Z","title":"Diffusion han- dles enabling 3d edits for diffusion models by lifting activations to 3d,","venue":null,"work_id":"41777d23-82ea-4a4c-96b5-d8f9e32fcc2f","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.386300Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:68a97e7b754970eadb606e2dcc9718787a6a2869505e35c380bf4cc173abc3cd","observation_id":"bb41aeed-78b1-4322-ac8a-e5af65299afb","resolution":{"observed_at":"2026-08-06T11:12:27.968558Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.949676Z","title":"Object 3dit: Language- guided 3d-aware image editing,","venue":null,"work_id":"4ab52c61-894e-4fbf-a95a-8f581b375a7f","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.390702Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:2c3eea09deee938983f558b6e8c042ff56fb1f5aa4dbb9a9823b794078d41eda","observation_id":"7d0ed862-dda8-425e-a75b-efc800f68996","resolution":{"observed_at":"2026-08-06T11:12:27.953977Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.19784","last_updated":"2023-12-07T15:22:07Z","snapshot_observed_at":"2026-07-06T16:40:39.567420Z","submitted_at":"2023-10-30T17:50:14Z","title":"CustomNet: Zero-shot Object Customization with Variable-Viewpoints in Text-to-Image Diffusion Models","version":2},"cited_work":{"arxiv_id":"2310.19784","doi":null,"metadata_source":"pith","pith_arxiv_id":"2310.19784","snapshot_observed_at":"2026-08-06T11:12:27.210165Z","title":"CustomNet: Zero-shot Object Customization with Variable-Viewpoints in Text-to-Image Diffusion Models","venue":"cs.CV","work_id":"ea5ebae2-0c5b-4069-85bc-c4baadcd4be3","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.394512Z"},"links":{"cited_paper":"/paper/2310.19784","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:f84c0820a6ef9c590d555d80fdda61415b3c0e7f11856c35aaedcd693dfbc727","observation_id":"5c87a31f-4619-46a9-a410-ad57514986d0","resolution":{"observed_at":"2026-08-06T11:12:27.215202Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2310.02601","last_updated":"2024-05-03T04:50:27Z","snapshot_observed_at":"2026-08-06T19:21:54.069156Z","submitted_at":"2023-10-04T06:14:06Z","title":"MagicDrive: Street View Generation with Diverse 3D Geometry Control","version":7},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.02601","snapshot_observed_at":"2026-08-06T11:12:26.398731Z","title":"Magicdrive: Street view generation with diverse 3d geometry con- trol,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.398731Z"},"links":{"cited_paper":"/paper/2310.02601","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:73950c7c7ef2d7c6f903d3f7eecb5bd3fae8c3777c34cfa7f45c697837da3f40","observation_id":"53e7f7a2-a707-4a1e-8fc7-d305ec38bea5","resolution":{"observed_at":"2026-08-06T11:12:26.398731Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.07771","last_updated":"2023-10-11T18:00:08Z","snapshot_observed_at":"2026-08-01T02:20:23.247164Z","submitted_at":"2023-10-11T18:00:08Z","title":"DrivingDiffusion: Layout-Guided multi-view driving scene video generation with latent diffusion model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.07771","snapshot_observed_at":"2026-08-06T11:12:26.402608Z","title":"Drivingdiffusion: Layout-guided multi-view driving scene video gen- eration with latent diffusion model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.402608Z"},"links":{"cited_paper":"/paper/2310.07771","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:7fc62c994638aafcacb220ae379fc3e1b05bc348511c0dd26a466cbf1fb18d09","observation_id":"0efba9dd-c046-42e9-9966-442b915e3f49","resolution":{"observed_at":"2026-08-06T11:12:26.402608Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.16813","last_updated":"2023-11-28T14:22:24Z","snapshot_observed_at":"2026-07-06T16:53:47.748963Z","submitted_at":"2023-11-28T14:22:24Z","title":"Panacea: Panoramic and Controllable Video Generation for Autonomous Driving","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.16813","snapshot_observed_at":"2026-08-06T11:12:26.406416Z","title":"Panacea: Panoramic and controllable video generation for autonomous driving,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.406416Z"},"links":{"cited_paper":"/paper/2311.16813","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:92ec1fba95e962f54c9488943df15ff4d294920d88232ccc97d9e0daca14f213","observation_id":"f5a18415-a9aa-48ee-8a5d-6340c0d6dee5","resolution":{"observed_at":"2026-08-06T11:12:26.406416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.04504","last_updated":"2024-02-07T01:18:49Z","snapshot_observed_at":"2026-08-03T18:27:06.653557Z","submitted_at":"2024-02-07T01:18:49Z","title":"Text2Street: Controllable Text-to-image Generation for Street Views","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2402.04504","snapshot_observed_at":"2026-08-06T11:12:26.410324Z","title":"T ext2street: Controllable text-to-image generation for street views,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.410324Z"},"links":{"cited_paper":"/paper/2402.04504","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:08289613aa6c294a00448c36224767545f7cee4e76afb44b5f298b2cac1f5fd8","observation_id":"4da80d98-ee44-4c99-8350-590c5dcd2943","resolution":{"observed_at":"2026-08-06T11:12:26.410324Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.19438","last_updated":"2024-12-26T10:33:31Z","snapshot_observed_at":"2026-07-06T17:52:34.385599Z","submitted_at":"2024-03-28T14:07:13Z","title":"SubjectDrive: Scaling Generative Data in Autonomous Driving via Subject Control","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.19438","snapshot_observed_at":"2026-08-06T11:12:26.414109Z","title":"Huang, Y","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.414109Z"},"links":{"cited_paper":"/paper/2403.19438","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ad26911691d4ba5508471153c894beaac5011946ba59f38ad752c503f207212a","observation_id":"6fdc2024-8845-4762-9848-7265139205df","resolution":{"observed_at":"2026-08-06T11:12:26.414109Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.05463","last_updated":"2024-09-12T12:32:21Z","snapshot_observed_at":"2026-07-06T19:12:23.792177Z","submitted_at":"2024-09-09T09:43:17Z","title":"DriveScape: Towards High-Resolution Controllable Multi-View Driving Video Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.05463","snapshot_observed_at":"2026-08-06T11:12:26.418036Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.418036Z"},"links":{"cited_paper":"/paper/2409.05463","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:94072288ac8d77945d8eb884a822a50cea6dae573c93b554adbc9482288e1a15","observation_id":"c6ebc59e-7e7a-4ef2-8f76-f25fb61f7b04","resolution":{"observed_at":"2026-08-06T11:12:26.418036Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.935893Z","title":null,"venue":null,"work_id":"50023bce-10de-4a40-a777-8c66cb6190d4","year":null},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.422385Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:e45aa85dd22615a3b3c0517586b45dc8552f2302621664028a9475b01c47e9c6","observation_id":"7f526eea-6928-4fe3-b6aa-689e060d50f4","resolution":{"observed_at":"2026-08-06T11:12:27.940293Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2209.03954","last_updated":"2022-09-24T04:10:52Z","snapshot_observed_at":"2026-07-06T13:50:18.095078Z","submitted_at":"2022-09-08T17:58:04Z","title":"Learning to Generate Realistic LiDAR Point Clouds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.03954","snapshot_observed_at":"2026-08-06T11:12:26.431130Z","title":"Zyrianov, X","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.431130Z"},"links":{"cited_paper":"/paper/2209.03954","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:80e960e0eb4087b73c19926390d376ce0edf5bdd6b232abeb107c3c7f3cc7d3f","observation_id":"d873b565-0aeb-42d6-b555-45e37db95f62","resolution":{"observed_at":"2026-08-06T11:12:26.431130Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.10094","last_updated":"2024-09-10T03:50:09Z","snapshot_observed_at":"2026-08-05T03:18:22.974009Z","submitted_at":"2024-03-15T08:19:57Z","title":"RangeLDM: Fast Realistic LiDAR Point Cloud Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2403.10094","snapshot_observed_at":"2026-08-06T11:12:26.435326Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.435326Z"},"links":{"cited_paper":"/paper/2403.10094","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:9dbfb32e84726b356f1efd693e9d62787fdd1e4aa023dd28786c353a70b1d09b","observation_id":"440a0825-c64f-4605-8df5-841d2e6972e6","resolution":{"observed_at":"2026-08-06T11:12:26.435326Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2311.01448","last_updated":"2023-11-02T17:57:03Z","snapshot_observed_at":"2026-07-06T16:42:19.938941Z","submitted_at":"2023-11-02T17:57:03Z","title":"UltraLiDAR: Learning Compact Representations for LiDAR Completion and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2311.01448","snapshot_observed_at":"2026-08-06T11:12:26.439471Z","title":"Xiong, W .-C","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.439471Z"},"links":{"cited_paper":"/paper/2311.01448","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:0336a79ac304e802384fc8062f73c88c85125759afe56e53cb8c2864a7365a1b","observation_id":"31eda483-9432-4261-a742-a107abebe9fb","resolution":{"observed_at":"2026-08-06T11:12:26.439471Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:26.443296Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.443296Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:df00485b9bb038a1e372bcae7af4b91aa109c9a7623c1d5f969808d1a6e38d30","observation_id":"17c4b21c-7899-4f86-b94a-4089286750c2","resolution":{"observed_at":"2026-08-06T11:12:26.443296Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2411.01123","last_updated":"2024-11-02T03:52:12Z","snapshot_observed_at":"2026-07-06T19:43:59.326124Z","submitted_at":"2024-11-02T03:52:12Z","title":"X-Drive: Cross-modality consistent multi-sensor data synthesis for driving scenarios","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2411.01123","snapshot_observed_at":"2026-08-06T11:12:26.447316Z","title":"X-drive: Cross-modality consistent multi-sensor data synthesis for driving scenarios,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.447316Z"},"links":{"cited_paper":"/paper/2411.01123","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:be6d2d778500759f566ea2da65a5cd23c09e9531a98011dd1d928b4c91e141f0","observation_id":"6fbcc043-8f52-44b9-b789-56a0e58dcb6e","resolution":{"observed_at":"2026-08-06T11:12:26.447316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2406.10722","last_updated":"2024-06-15T19:29:01Z","snapshot_observed_at":"2026-07-06T18:31:36.504766Z","submitted_at":"2024-06-15T19:29:01Z","title":"GenMM: Geometrically and Temporally Consistent Multimodal Data Generation for Video and LiDAR","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2406.10722","snapshot_observed_at":"2026-08-06T11:12:26.451811Z","title":"Genmm: Geomet- rically and temporally consistent multimodal data generation for video and lidar,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.451811Z"},"links":{"cited_paper":"/paper/2406.10722","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b240660db509db0eeecbdd70438e6d768cdd2b37ba9e0c658fdabed26d1abd40","observation_id":"ca8553f1-0d03-4bca-9373-64325d27aefd","resolution":{"observed_at":"2026-08-06T11:12:26.451811Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2205.13790","last_updated":"2022-11-11T16:07:31Z","snapshot_observed_at":"2026-07-06T13:14:33.576055Z","submitted_at":"2022-05-27T06:58:30Z","title":"BEVFusion: A Simple and Robust LiDAR-Camera Fusion Framework","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2205.13790","snapshot_observed_at":"2026-08-06T11:12:26.456782Z","title":"Liang, H","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.456782Z"},"links":{"cited_paper":"/paper/2205.13790","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:e9e837f2735f6c2a693287f2038de18aba9db2c83888cda4f32e416cd01934ad","observation_id":"a3256dee-8582-4f94-a8bb-af88110c72dd","resolution":{"observed_at":"2026-08-06T11:12:26.456782Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.922783Z","title":"Bevfusion: Multi-task multi-sensor fusion with unified bird’s-eye view representation,","venue":null,"work_id":"8d714a73-9c24-4c6e-b993-b598e560be01","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.461070Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:bc6c047050edb1b824d056286d1e7c987460ad559837da82ab1335e70d5f0f67","observation_id":"aa7f6fb2-245a-47c1-9373-313e8a2afe15","resolution":{"observed_at":"2026-08-06T11:12:27.926851Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.14919","last_updated":"2024-05-21T16:47:13Z","snapshot_observed_at":"2026-07-06T17:07:19.721701Z","submitted_at":"2023-12-22T18:51:50Z","title":"Lift-Attend-Splat: Bird's-eye-view camera-lidar fusion using transformers","version":3},"cited_work":{"arxiv_id":"2312.14919","doi":null,"metadata_source":"pith","pith_arxiv_id":"2312.14919","snapshot_observed_at":"2026-08-06T11:12:26.862931Z","title":"Lift-Attend-Splat: Bird's-eye-view camera-lidar fusion using transformers","venue":"cs.CV","work_id":"56a7ff23-0178-4c95-9566-89fb89e24277","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.464921Z"},"links":{"cited_paper":"/paper/2312.14919","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:594758fd269d358c5e5f2ed34d932c23194e67950279d732dd87c2b525714012","observation_id":"665017ff-3267-4db1-b8f0-2565070b8262","resolution":{"observed_at":"2026-08-06T11:12:26.874188Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1702.07836","last_updated":"2017-09-08T00:29:55Z","snapshot_observed_at":"2026-07-06T05:31:22.319094Z","submitted_at":"2017-02-25T06:04:42Z","title":"Synthesizing Training Data for Object Detection in Indoor Scenes","version":2},"cited_work":{"arxiv_id":"1702.07836","doi":null,"metadata_source":"pith","pith_arxiv_id":"1702.07836","snapshot_observed_at":"2026-08-06T11:12:26.842370Z","title":"Synthesizing Training Data for Object Detection in Indoor Scenes","venue":"cs.CV","work_id":"c4726077-06ac-4513-9f02-7fde2111872a","year":2017},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.469023Z"},"links":{"cited_paper":"/paper/1702.07836","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:e2266b855530a1dfd56c6d3274b1d6a0c33ee8da9b20dcd9d1e4b7276d596855","observation_id":"b2aa490a-496d-47aa-b6e5-535070da8458","resolution":{"observed_at":"2026-08-06T11:12:26.847157Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.910109Z","title":"Cut, paste and learn: Surprisingly easy synthesis for instance detection,","venue":null,"work_id":"87198cb7-4b4b-424e-8fac-fb838223f52d","year":2017},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.472915Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:f788ef8d32fbdda07c0cc67abaae09fa3c1be9e54625484379ef0fb682319946","observation_id":"ea3ee91b-1320-4a49-a75b-089a231b47a3","resolution":{"observed_at":"2026-08-06T11:12:27.913865Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.897476Z","title":"Simple copy-paste is a strong data augmentation method for instance segmentation,","venue":null,"work_id":"2d7e64e3-9a5a-4ea4-985f-c554f2f7dcb7","year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.476547Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:d802693092522ac6ef03381f3ff260bda56cfaa1e0c0c92febdc62a6abc96e83","observation_id":"2d69e29a-9118-4da6-90a9-d4442eacc424","resolution":{"observed_at":"2026-08-06T11:12:27.901440Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.884440Z","title":"Pointaugmenting: Cross-modal augmentation for 3d ob- ject detection,","venue":null,"work_id":"8485aae4-a704-42ad-8d91-484827f8f647","year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.480552Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:038106809fae0cf9a727aea59f8000db913096360fc475585214e0452c214fa1","observation_id":"dc3edda2-1a6f-494f-8686-e4827624c36b","resolution":{"observed_at":"2026-08-06T11:12:27.888698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.870779Z","title":"Second: Sparsely embedded convolutional detection,","venue":null,"work_id":"f164f702-e5d7-4a8d-9326-ee120a886238","year":2018},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.484474Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:a77e847ffe42babe2c0fdfe5f04ca4e660c65f2d01f2645eb56238e108efcae9","observation_id":"13c249ba-afcc-4bf4-af9e-9d61623e935c","resolution":{"observed_at":"2026-08-06T11:12:27.874960Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.857904Z","title":"Cutmix: Regularization strategy to train strong classifiers with localizable features,","venue":null,"work_id":"96b75df2-ad02-4f2a-9ee7-d1af12a54a09","year":2019},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.488552Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:5cf73acca3b98b52fbc7e6054d55b74ff9dd2eb953ba93a23327b89208a7e7ee","observation_id":"43830762-797c-4e39-8a87-4cd00f54bd31","resolution":{"observed_at":"2026-08-06T11:12:27.861937Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2012.12741","last_updated":"2021-04-21T16:23:20Z","snapshot_observed_at":"2026-07-06T10:27:20.454281Z","submitted_at":"2020-12-23T15:23:16Z","title":"Exploring Data Augmentation for Multi-Modality 3D Object Detection","version":2},"cited_work":{"arxiv_id":"2012.12741","doi":null,"metadata_source":"pith","pith_arxiv_id":"2012.12741","snapshot_observed_at":"2026-08-06T11:12:26.821912Z","title":"Exploring Data Augmentation for Multi-Modality 3D Object Detection","venue":"cs.CV","work_id":"1e13a555-4978-4e8e-8d30-71d22c12e8d6","year":2020},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.492445Z"},"links":{"cited_paper":"/paper/2012.12741","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:63441833212646c955d15004625bdb9249659b5ecf6163bdfae274d5b0ed2fb6","observation_id":"1be9cc99-987f-449a-b6a2-064305cc9f69","resolution":{"observed_at":"2026-08-06T11:12:26.826848Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.844894Z","title":"Exploring geometric consistency for monocular 3d object detection,","venue":null,"work_id":"1284d545-be61-46e5-83fb-bbb07b41a492","year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.496471Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:73b9760b1c66d5e18d888fb6c431afa371e8785b5b97de7d93e39791b0fdc2e3","observation_id":"43cab671-8ca4-41ed-bdc8-8d15d3268c4d","resolution":{"observed_at":"2026-08-06T11:12:27.848938Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2308.01661","last_updated":"2023-09-23T06:59:18Z","snapshot_observed_at":"2026-08-06T17:02:57.215189Z","submitted_at":"2023-08-03T09:56:31Z","title":"BEVControl: Accurately Controlling Street-view Elements with Multi-perspective Consistency via BEV Sketch Layout","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.01661","snapshot_observed_at":"2026-08-06T11:12:26.500187Z","title":"Bevcontrol: Accurately controlling street-view elements with multi-perspective consistency via bev sketch layout,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":60,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.500187Z"},"links":{"cited_paper":"/paper/2308.01661","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:0e5f4df0900923ca5a8612983589bb4d85c952717e0016ca9f73a5b1a2162948","observation_id":"7fbf189d-9da0-47c0-ab96-6e9d69d7f778","resolution":{"observed_at":"2026-08-06T11:12:26.500187Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.831760Z","title":"Synthetic lidar point cloud generation using deep gener- ative models for improved driving scene object recognition,","venue":null,"work_id":"99b92926-8f3d-4e9f-bd9c-6cf5b27b66f9","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.504328Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:a7e34ccb6c4ab9b44727c3891f75c0ad0d9f7807db380ab001069fe104cf457a","observation_id":"172fc67f-68f3-4f05-861c-8636228c157f","resolution":{"observed_at":"2026-08-06T11:12:27.835761Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.818749Z","title":"Deep unsupervised learning us- ing nonequilibrium thermodynamics,","venue":null,"work_id":"56926568-7832-4f85-aefc-00838eca2189","year":2015},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.508518Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:eb1e1369e3fed302285b1ca10cbefaa7deced6c9b9899f6f5dd229c6e965adf6","observation_id":"2e9dda35-df5c-468c-87c8-f1c459ae68b0","resolution":{"observed_at":"2026-08-06T11:12:27.822803Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.805150Z","title":"Nuscenes: A multimodal dataset for autonomous driv- ing,","venue":null,"work_id":"85f1c59d-21e5-42a0-b87d-23d250c10b3c","year":2020},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":63,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.512200Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:697343ed26108ad41f8600b0a5cbfd52f4ed0c89e27ce2474d7ede8d087941a3","observation_id":"d7647ef1-58fd-4ad2-8392-46701237c7e8","resolution":{"observed_at":"2026-08-06T11:12:27.809154Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.792099Z","title":"Deep residual learning for image recognition,","venue":null,"work_id":"1269e3b0-720c-4e2b-9954-1959b57d52b6","year":2016},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":64,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.515841Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b1249f0ab55ea25e489ea5a4b9f24baea81b07343f89c3a087a31f984e22b529","observation_id":"8db81fc7-e71e-470a-8fb8-ddeb48588b69","resolution":{"observed_at":"2026-08-06T11:12:27.796118Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.778678Z","title":"T aming transformers for high-resolution image synthe- sis,","venue":null,"work_id":"55536fe3-b1c4-433c-8ff7-50b01ebaf285","year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":65,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.519792Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:20c2c72847a8b55817ee2e121336ec8dc5670f2c1ce152cde57c41bedc46a814","observation_id":"0fceecea-0de9-4533-b1ea-166f849014c7","resolution":{"observed_at":"2026-08-06T11:12:27.783016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.765543Z","title":"Learning transferable visual models from natural lan- guage supervision,","venue":null,"work_id":"f5e41141-4cef-41cb-b849-8c126206eb8b","year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":66,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.523387Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:bdb031e031d3c0be852015f42a475eba52ff5fc7169ba373be6c807b7371e924","observation_id":"085e34ed-1f76-41ef-8104-923420569f2c","resolution":{"observed_at":"2026-08-06T11:12:27.769742Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-06T05:58:29.182448Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-06T11:12:26.527021Z","title":"Dinov2: Learning robust visual features without su- pervision,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":67,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.527021Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b8de591593bb4961a22249de2f617e6099d74de0fec539d5ad1193bad67d7629","observation_id":"7e12a163-63b7-4b69-bded-53bbc50fecb6","resolution":{"observed_at":"2026-08-06T11:12:26.527021Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.751296Z","title":"Flamingo: A visual language model for few-shot learn- ing,","venue":null,"work_id":"cdb761d5-355c-4e07-a202-45f0434de2a1","year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":68,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.530758Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:7b2def81ee93a5c150f0edab383f278684b92906c769699e1b13086fb6749aa8","observation_id":"5d3084c9-a1b4-421b-a10f-7d39d7c36d55","resolution":{"observed_at":"2026-08-06T11:12:27.756311Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2207.12598","last_updated":"2022-07-26T01:42:07Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2022-07-26T01:42:07Z","title":"Classifier-Free Diffusion Guidance","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2207.12598","snapshot_observed_at":"2026-08-06T11:12:26.534376Z","title":"Classifier-free diffusion guidance,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":69,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.534376Z"},"links":{"cited_paper":"/paper/2207.12598","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:4b521a833c3efea846108d62bc613c68c352f19fcbdedc882b1488866f23f7f5","observation_id":"efb2661f-ddac-4751-91af-d9be604bc133","resolution":{"observed_at":"2026-08-06T11:12:26.534376Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2402.16392","last_updated":"2024-07-12T18:19:19Z","snapshot_observed_at":"2026-08-05T01:35:52.697907Z","submitted_at":"2024-02-26T08:32:41Z","title":"Placing Objects in Context via Inpainting for Out-of-distribution Segmentation","version":2},"cited_work":{"arxiv_id":"2402.16392","doi":null,"metadata_source":"pith","pith_arxiv_id":"2402.16392","snapshot_observed_at":"2026-08-06T11:12:26.756032Z","title":"Placing Objects in Context via Inpainting for Out-of-distribution Segmentation","venue":"cs.CV","work_id":"b613a4de-e99a-4359-a856-4ada26073550","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":70,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.538760Z"},"links":{"cited_paper":"/paper/2402.16392","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:a211595b19b5d65213a1c0bf5874b5d1340b86724621bccf75b217c7476cbf62","observation_id":"905b1424-2e25-4b7d-a478-c8713e83b3fe","resolution":{"observed_at":"2026-08-06T11:12:26.760867Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.737661Z","title":"Gans trained by a two time-scale update rule converge to a local nash equilibrium,","venue":null,"work_id":"5078bf96-7b46-4a26-b1c0-25b9c26f9c2e","year":2017},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":71,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.542751Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:4cc121ee1492ea924c82afea46ae62dad68923cf027e8d581534377bd712d6d5","observation_id":"deb29c18-94b7-4a99-8328-d9f17bc7a84a","resolution":{"observed_at":"2026-08-06T11:12:27.741731Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.724760Z","title":"The unreasonable effectiveness of deep features as a perceptual metric,","venue":null,"work_id":"53ecc9eb-66cc-4cc7-916d-2dbea6e67e9b","year":2018},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":72,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.546436Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ed7d9a51506f8735559af70d7a408b30d5cba868ec132d97b55a09565d5d0074","observation_id":"6ff655d4-aa70-409a-97ef-85d27f3cd555","resolution":{"observed_at":"2026-08-06T11:12:27.728921Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.711619Z","title":"Dreambooth: Fine tuning text-to-image diffusion models for subject-driven generation,","venue":null,"work_id":"16e1cde7-dea8-4140-9447-6fc0eec8287f","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":73,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.550648Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:6743c634cc359d4b1f7f04cd3c4c7dbc86ca23b71a3be06d89264bc599142afd","observation_id":"349750d0-683d-4334-8223-7b67ba361d9b","resolution":{"observed_at":"2026-08-06T11:12:27.716025Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.698890Z","title":"Going deeper with convolutions,","venue":null,"work_id":"c551800e-e99d-4912-b238-363be3a9c8a5","year":2015},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":74,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.554402Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:e6304f808388e7c36e90a55f3ee73aa9d8cdd261f5105f7c3a6813ca73dbeac6","observation_id":"65aa90ae-2685-413e-8672-02aac098479b","resolution":{"observed_at":"2026-08-06T11:12:27.702772Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.686231Z","title":"Lidar data synthesis with denoising diffusion probabilistic mod- els,","venue":null,"work_id":"ceda8962-0c6e-406c-ad01-9216c4b126b8","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":75,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.558906Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:db9a08a30db3101b52288ccd5aa02e2446a9bd6fb42e538fe9308b6ee5db5fe6","observation_id":"469af669-6a9f-4dbb-9e76-f69d5b8e9195","resolution":{"observed_at":"2026-08-06T11:12:27.690214Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.673278Z","title":"Swin transformer: Hierarchical vision transformer using shifted win- dows,","venue":null,"work_id":"2b13ca9a-03b0-4a3a-b607-481951d37d15","year":2021},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":76,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.562681Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:5ed2d63ae7e907922698e6603667c2e0eefe1b53fecf8eab12ed53654df6cbe9","observation_id":"7c933eaf-22c3-4b0e-adff-a63bb847e317","resolution":{"observed_at":"2026-08-06T11:12:27.677454Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.659567Z","title":"Controllable and efficient multi-class pathology nuclei data augmenta- tion using text-conditioned diffusion models,","venue":null,"work_id":"7f11539d-c3a9-4105-be51-c2c5e0e67c33","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":77,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.566803Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:1cdc192ff890c407645ae50dcc07899f8f46f313d270e419a0148a8bd502e825","observation_id":"6ca37b34-c9e1-43d6-8b3b-6f96d04cf904","resolution":{"observed_at":"2026-08-06T11:12:27.663788Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.645953Z","title":"Prism: High-resolution & precise counterfactual medical image generation using language-guided stable diffusion,","venue":null,"work_id":"05863c96-7c89-4b1d-bd95-53985008b846","year":2025},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":78,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.570319Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:ab9b6dc3338ca3597d45440e468168972e0ec1d4a0d8927c9fe00a98d566448c","observation_id":"03fded4e-eda5-42c6-bc66-0f536ceda224","resolution":{"observed_at":"2026-08-06T11:12:27.650104Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.632116Z","title":"Denoising diffusion models for 3d healthy brain tissue in- painting,","venue":null,"work_id":"b298b173-2ade-4e7c-8bbc-56c05cb6d699","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":79,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.574048Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:6f6894603c4f11116a0b6e97a971bb9e6e7b5040156247e537eaa35f3f4e8668","observation_id":"6d95423d-e62b-4f26-a1bb-762dfe065969","resolution":{"observed_at":"2026-08-06T11:12:27.636356Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.619364Z","title":"St-gan: Spatial transformer generative adversarial networks for image compositing,","venue":null,"work_id":"0968daeb-2213-4c7a-ad56-7209108ae826","year":2018},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":80,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.577848Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:864a11b9cf215bd729e9a409a880538641da77c8e76a8c604e29e1499c170b8b","observation_id":"e1a1fa89-0ab0-4a86-a825-9a3655f32c04","resolution":{"observed_at":"2026-08-06T11:12:27.623324Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"1406.2661","last_updated":"2014-06-10T18:58:17Z","snapshot_observed_at":"2026-07-06T03:46:00.791740Z","submitted_at":"2014-06-10T18:58:17Z","title":"Generative Adversarial Networks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1406.2661","snapshot_observed_at":"2026-08-06T11:12:26.581941Z","title":null,"venue":null,"work_id":null,"year":2014},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":81,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.581941Z"},"links":{"cited_paper":"/paper/1406.2661","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:b3aef3677a69373a94b23b20150c88351448c2f48094186d569e9f7d54ba8582","observation_id":"379f1b3d-95de-493e-b721-5fe63b4ac3dc","resolution":{"observed_at":"2026-08-06T11:12:26.581941Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.606307Z","title":"Objectstitch: Object compositing with diffusion model,","venue":null,"work_id":"6d12b3db-9a65-44df-ac38-00918ebaa777","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":82,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.585965Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:40f076af1dacc4a8c73d7e3c4d95a8aed0f4ad8549d75d99e99eef0d8c09496f","observation_id":"d7a5db88-607a-4f16-a4df-93464011acc8","resolution":{"observed_at":"2026-08-06T11:12:27.610701Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.02643","last_updated":"2023-04-05T17:59:46Z","snapshot_observed_at":"2026-07-06T15:12:37.953383Z","submitted_at":"2023-04-05T17:59:46Z","title":"Segment Anything","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.02643","snapshot_observed_at":"2026-08-06T11:12:26.590374Z","title":"Segment anything,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":83,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.590374Z"},"links":{"cited_paper":"/paper/2304.02643","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:e45da109626ca288d8025b9382aebf1b05eef2401a1943b6b0d7ba67de56f878","observation_id":"be048089-9c63-4a7c-996e-6e410160f944","resolution":{"observed_at":"2026-08-06T11:12:26.590374Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2403.18818","last_updated":"2024-03-27T17:59:52Z","snapshot_observed_at":"2026-07-06T17:52:05.486230Z","submitted_at":"2024-03-27T17:59:52Z","title":"ObjectDrop: Bootstrapping Counterfactuals for Photorealistic Object Removal and Insertion","version":1},"cited_work":{"arxiv_id":"2403.18818","doi":null,"metadata_source":"pith","pith_arxiv_id":"2403.18818","snapshot_observed_at":"2026-08-06T11:12:26.702025Z","title":"ObjectDrop: Bootstrapping Counterfactuals for Photorealistic Object Removal and Insertion","venue":"cs.CV","work_id":"a073551b-252a-489c-ac02-bf4f7e3d0034","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":84,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.594245Z"},"links":{"cited_paper":"/paper/2403.18818","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:8a7d02783ab02c9f4bb94d7b38ff7bc7fd3c60762256c1631a06b2236571b9f4","observation_id":"2d014b55-4fbc-4e30-a2c1-e6c3640e507d","resolution":{"observed_at":"2026-08-06T11:12:26.708484Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.593271Z","title":"Anatomically-controllable medical image generation with segmentation-guided diffusion models,","venue":null,"work_id":"45b9a6df-d2be-46e9-a0ce-d617af73463a","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":85,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.598282Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:abc48762fa1a170369381062c8594585ea23401f2b10e36cab9af34d255adb97","observation_id":"e72d13e5-0cae-4ab7-8dcd-fa19e78bb4ed","resolution":{"observed_at":"2026-08-06T11:12:27.597234Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.580391Z","title":"Mededit: Counterfactual diffusion-based image editing on brain mri,","venue":null,"work_id":"dd089b05-6220-403f-befb-c5d2b459b4f3","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":86,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.602120Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:e4fcf280d66269f3454e651dff07dfbf9ce8ea5cfe45a469b8a8d2cb26244ed2","observation_id":"021cb827-bbc1-499d-8add-1a63b22559df","resolution":{"observed_at":"2026-08-06T11:12:27.584464Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.566697Z","title":"Diffusion models with implicit guid- ance for medical anomaly detection,","venue":null,"work_id":"34b5b923-3e2f-4e70-b551-d47ac0adc4c0","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":87,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.606232Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:f9a0de6d71f439a58c95c5c516cd8c80583d71832603fa6eb9d2042130af8783","observation_id":"b7f5c351-5643-4289-84a2-820d19b94d8f","resolution":{"observed_at":"2026-08-06T11:12:27.571252Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.553077Z","title":"Radedit: Stress-testing biomedical vision mod- els via diffusion image editing,","venue":null,"work_id":"1f4e31ef-75d4-4ac2-87cf-5702b11f31d4","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":88,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.610388Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:868fbfb9e601eabb5cc9dcefb2ba6fdb5c2bbc57be3712e3a92690b295cab995","observation_id":"2bbdaeee-a54e-43e5-8bc8-d9723674d25e","resolution":{"observed_at":"2026-08-06T11:12:27.557267Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.538202Z","title":"Diffusion models for counterfac- tual generation and anomaly detection in brain images,","venue":null,"work_id":"c7886381-d7df-4ad5-ad97-f8a7f4109ff3","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":89,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.614288Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:8936f45a9f43db2f6e877fc3e7ecf11f2f6d41b719811bda32caff117b7144ed","observation_id":"cbd66750-7680-4cda-a2a9-93d5c45a761f","resolution":{"observed_at":"2026-08-06T11:12:27.543016Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.521854Z","title":"Vindr-mammo: A large-scale benchmark dataset for computer-aided diagnosis in full-field digital mammography,","venue":null,"work_id":"9dac8f58-e8e6-480f-9d3e-a76d5cb6226f","year":2023},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":90,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.618164Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:225fea48297bcff3cd41e2a6ba0907197b151e76bd38794f4c52124c3422a9e3","observation_id":"27c23e9c-332b-4c29-934f-f02ef4ac07f1","resolution":{"observed_at":"2026-08-06T11:12:27.526538Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.507030Z","title":"D’Orsi, E","venue":null,"work_id":"5699d5ff-41e7-4df4-ada6-c4f16d7fca06","year":2013},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":91,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.621895Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:86183f6517370e67c08a653de235b3a75144492a8e244651cc26f1352d9ceefd","observation_id":"d05a9d39-e769-4d5f-815b-f0ad7d0b735a","resolution":{"observed_at":"2026-08-06T11:12:27.511197Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2010.11929","last_updated":"2021-06-03T13:08:56Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2020-10-22T17:55:59Z","title":"An Image is Worth 16x16 Words: Transformers for Image Recognition at Scale","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2010.11929","snapshot_observed_at":"2026-08-06T11:12:26.625897Z","title":"An image is worth 16x16 words: T ransformers for image recognition at scale,","venue":null,"work_id":null,"year":2010},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":92,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.625897Z"},"links":{"cited_paper":"/paper/2010.11929","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:5356345fc80d3066a86f6c84b3016f734dc348e4f102278348dc6c5038ebdc0a","observation_id":"15afb3d4-d148-4498-b428-6e2bfb523cae","resolution":{"observed_at":"2026-08-06T11:12:26.625897Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.492595Z","title":"Adam: A method for stochastic optimization,","venue":null,"work_id":"367ab566-5c1d-4020-a5ff-7adb62deb4bb","year":2014},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":93,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.629980Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:c39d038a6e9e2a4fc1d655715178b883423692bdfa6956829e03467496d6bf2e","observation_id":"e07e0742-f9df-4ece-b728-c4c94ed1ea0a","resolution":{"observed_at":"2026-08-06T11:12:27.496858Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.477647Z","title":"W ovogen: W orld volume-aware diffusion for controllable multi-camera driving scene generation,","venue":null,"work_id":"feeb984a-dc00-428c-97e8-93bb7fd8b02b","year":2025},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":94,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.633792Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:d95ca614830804ac2be19c7051d118872aba4b097c890f33707afa2a4ae9332a","observation_id":"298827ff-673b-42bf-a93a-248868549c05","resolution":{"observed_at":"2026-08-06T11:12:27.481979Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-06T11:12:27.462827Z","title":"Simple open-vocabulary object detection,","venue":null,"work_id":"df47a152-e6a3-43ed-bb52-5f83b51011b4","year":2022},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":95,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.637584Z"},"links":{"citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:565d8df74f98dd63424c842486694db4459c8d6e26862a17b1656d5f671d6248","observation_id":"4f973538-e8ef-4dc6-9240-cadcb2efcccd","resolution":{"observed_at":"2026-08-06T11:12:27.467559Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2404.00815","last_updated":"2024-04-18T19:22:37Z","snapshot_observed_at":"2026-08-01T18:27:23.492994Z","submitted_at":"2024-03-31T22:18:56Z","title":"Towards Realistic Scene Generation with LiDAR Diffusion Models","version":2},"cited_work":{"arxiv_id":"2404.00815","doi":null,"metadata_source":"pith","pith_arxiv_id":"2404.00815","snapshot_observed_at":"2026-08-06T11:12:27.096723Z","title":"Towards Realistic Scene Generation with LiDAR Diffusion Models","venue":"cs.CV","work_id":"4624c843-f716-4616-974c-4b384ce464d2","year":2024},"citing_paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-06T11:12:26.426578Z"},"links":{"cited_paper":"/paper/2404.00815","citing_paper":"/paper/2507.23058"},"observation_digest":"sha256:d8c18e9aa31c9f042a817041f8da6f54f8bc91d83c5c1af3845bffde1b0d4ca3","observation_id":"a26296bc-7985-4128-8edc-8eaad1a88cae","resolution":{"observed_at":"2026-08-06T11:12:27.101813Z","resolver_source":"local_arxiv","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}}],"paper":{"arxiv_id":"2507.23058","last_updated":"2025-07-30T19:43:47Z","latest_version":1,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T17:03:37.349064Z","submitted_at":"2025-07-30T19:43:47Z","title":"Reference-Guided Diffusion Inpainting For Multimodal Counterfactual Generation"},"reference_resolution":{"displayed":96,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":44,"verified_exact":10,"verified_fuzzy":41},"total_outbound_references":96},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 7 August 2026, this Paper Citation Record lists 96 of 96 outbound references and 0 inbound Pith citation observations for arXiv:2507.23058."}