{"as_of":"2026-08-20T12:03:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:c2a1c7c772d5de6b2d4fc006b5a3f8299eec478d3b28b669ac4c83b574457c50","coverage":[{"denominator":35,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":35,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-11T23:49:50.312022Z","state":"measured"},{"denominator":36,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":36,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-20T06:33:59.587034+00:00","state":"measured"},{"denominator":1,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":1,"source":"paper_references, paper_reference_links","source_observed_at":"2026-05-10T19:16:51.134397Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"arxiv_reference","source_observed_at":"2026-05-10T23:15:47.690569Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"cited_work":{"arxiv_id":"2412.02237","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":"2412.02237","snapshot_observed_at":"2026-06-05T21:23:00.469572Z","title":"Cross-attention head position pat- terns can align with human visual concepts in text-to-image generative models","venue":null,"work_id":"20ccb236-f5e4-4dc7-95fa-51bf934fa1d6","year":2024},"citing_paper":{"arxiv_id":"2604.05906","last_updated":"2026-04-07T14:09:00Z","snapshot_observed_at":"2026-08-07T17:46:47.345301Z","submitted_at":"2026-04-07T14:09:00Z","title":"Selective Aggregation of Attention Maps Improves Diffusion-Based Visual Interpretation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-05-10T19:16:51.134397Z"},"links":{"cited_paper":"/paper/2412.02237","citing_paper":"/paper/2604.05906"},"observation_digest":"sha256:5f11b2f13ab354c26bcec0b33b0a794c2eb0eff242374335a72b406cca2bca5f","observation_id":"bf81153b-0dfc-4785-baa4-b752cb66e116","resolution":{"observed_at":"2026-05-10T23:15:47.693742Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}}],"links":{"evidence":"/evidence","html":"/paper/2412.02237/citation-record","integrity":"/paper/2412.02237/integrity","json":"/paper/2412.02237/citation-record.json","paper":"/paper/2412.02237"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.507204Z","title":"Table 11 lists the 12 animals and 10 colors used to generate these prompts, with the full prompt list available in our core codebase","venue":null,"work_id":"9e01d55d-156a-4c2c-b2cc-2d562a30c747","year":2024},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.295816Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:e43e4ead5d7450e053edae067243a83782b3087f3e237d02af6f670a4ac9b586","observation_id":"92c095c2-2ebe-448f-960f-96e07159766c","resolution":{"observed_at":"2026-08-11T23:49:50.511328Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.653536Z","title":null,"venue":null,"work_id":"0d213f22-758d-44b6-b3fd-419513cd484d","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.247426Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:608ed158243c837f257c270e6a2b282af482a27c2bfb3b18fddc0e27c6432b24","observation_id":"24a30692-1a84-44b5-b25c-c8fc1418addb","resolution":{"observed_at":"2026-08-11T23:49:50.657393Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.628545Z","title":"A larger (LeRHF − MoRHF) area indicates that the ordering of CA heads better reflects the relevance of the corresponding concept","venue":null,"work_id":"b2f05541-e530-4284-ba41-f70b586401a5","year":null},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.255562Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:4e2afdfc27fa9709215ae886519b090e1cd00415de17c730e506c200e58d79a7","observation_id":"a449c785-1108-49e3-b2f7-b1e0e1157bad","resolution":{"observed_at":"2026-08-11T23:49:50.632683Z","resolver_source":"raw_fallback","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2208.01626","last_updated":"2022-08-02T17:55:41Z","snapshot_observed_at":"2026-08-17T00:44:11.103098Z","submitted_at":"2022-08-02T17:55:41Z","title":"Prompt-to-Prompt Image Editing with Cross Attention Control","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2208.01626","snapshot_observed_at":"2026-08-11T23:49:50.190975Z","title":"Amir Hertz, Ron Mokady, Jay Tenenbaum, Kfir Aberman, Yael Pritch, and Daniel Cohen-Or","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.190975Z"},"links":{"cited_paper":"/paper/2208.01626","citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:8ec8b3a80c5904fb9a24ab1f7da58d46b97e488c6bb08f976fe7813c96ccf142","observation_id":"2affa6b2-1337-40e0-9b4c-c166b7e612bf","resolution":{"observed_at":"2026-08-11T23:49:50.190975Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2108.01073","last_updated":"2022-01-05T00:07:35Z","snapshot_observed_at":"2026-08-16T16:53:14.231987Z","submitted_at":"2021-08-02T17:59:47Z","title":"SDEdit: Guided Image Synthesis and Editing with Stochastic Differential Equations","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2108.01073","snapshot_observed_at":"2026-08-11T23:49:50.199522Z","title":"Sdedit: Guided image synthesis and editing with stochastic differential equations","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.199522Z"},"links":{"cited_paper":"/paper/2108.01073","citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:781feeca2c19987f1088eabaa6c1bfc6aa23821acd1a7e2b6ae25d30e6dda9e8","observation_id":"ed5c1671-80ef-423c-a4c7-0d865bf88030","resolution":{"observed_at":"2026-08-11T23:49:50.199522Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.604758Z","title":"Count how many of the following five images contain{intended meaning of the polysemous word} but no {unintended meaning of the polysemous word }","venue":null,"work_id":"643094b8-62a0-4697-bec4-91d9f63b6ce2","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.263430Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:494670b1c85861153dcce761bb1922dc2c685fd90eb71b0ab4f86607ca4c4ff1","observation_id":"9516ee1c-2995-4d6b-949a-c7860ee30310","resolution":{"observed_at":"2026-08-11T23:49:50.608873Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2304.07193","last_updated":"2024-02-02T10:24:09Z","snapshot_observed_at":"2026-08-17T13:03:40.359628Z","submitted_at":"2023-04-14T15:12:19Z","title":"DINOv2: Learning Robust Visual Features without Supervision","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.07193","snapshot_observed_at":"2026-08-11T23:49:50.207748Z","title":"Maxime Oquab, Timoth ´ee Darcet, Th ´eo Moutakanni, Huy V o, Marc Szafraniec, Vasil Khalidov, Pierre Fernandez, Daniel Haziza, Francisco Massa, Alaaeldin El-Nouby, et al","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.207748Z"},"links":{"cited_paper":"/paper/2304.07193","citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:c11a7f8dc0010b41990585a881136a0f83ff8c77f77b23ff51b6dd27720cf4d1","observation_id":"c611356c-e6bb-4176-9519-6c9bc2df152f","resolution":{"observed_at":"2026-08-11T23:49:50.207748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.828110Z","title":"Zero-shot image-to-image translation","venue":null,"work_id":"07960b1e-9013-4b1e-9474-3fde44520c23","year":2023},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.211902Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:46f894a48ca751d307352d5f87c35835d64631ad26e27f5ab205cf155d4d2329","observation_id":"65e66eb9-74a5-4315-bc62-9baeedbda4cc","resolution":{"observed_at":"2026-08-11T23:49:50.832220Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.815591Z","title":"Controlling generative models with continuous factors of variations","venue":null,"work_id":"20d91cce-f669-4d7a-849c-021559c5df74","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.215722Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:23095a2cbfdcff152f32ebac5f24b7f1063f99c66f1d91f7d9001f8d9acc9d26","observation_id":"f54045b0-7e26-4043-98b9-6cce7dd88309","resolution":{"observed_at":"2026-08-11T23:49:50.819854Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.802756Z","title":"PromptHero","venue":null,"work_id":"cb2c5cdd-cabe-4321-8304-2d33f79bf2bb","year":2024},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.220075Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:fe1e55046b636b9a5c5f3274402cb84b6a764e6ac76da5fda496419186c319ac","observation_id":"aad47d13-616c-4a73-8691-89701026f704","resolution":{"observed_at":"2026-08-11T23:49:50.807190Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.00714","last_updated":"2024-10-28T16:37:57Z","snapshot_observed_at":"2026-07-06T18:55:41.459417Z","submitted_at":"2024-08-01T17:00:08Z","title":"SAM 2: Segment Anything in Images and Videos","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2408.00714","snapshot_observed_at":"2026-08-11T23:49:50.223823Z","title":"Sam 2: Segment anything in images and videos","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.223823Z"},"links":{"cited_paper":"/paper/2408.00714","citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:7d3e78192256605a9b1b99d0e4b34cf74afc8f53d4ba1888943054ac1f9f1b27","observation_id":"d772e344-90f0-4b8b-bb53-3b4d47206d8d","resolution":{"observed_at":"2026-08-11T23:49:50.223823Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2401.14159","last_updated":"2024-01-25T13:12:09Z","snapshot_observed_at":"2026-07-06T17:20:25.138890Z","submitted_at":"2024-01-25T13:12:09Z","title":"Grounded SAM: Assembling Open-World Models for Diverse Visual Tasks","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2401.14159","snapshot_observed_at":"2026-08-11T23:49:50.228272Z","title":"Grounded sam: Assembling open-world models for diverse visual tasks","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.228272Z"},"links":{"cited_paper":"/paper/2401.14159","citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:d2b92d83fd173fd04956d8d71027928a8ada555364d06db8c0d87784c0e2fd91","observation_id":"c58dc8cd-0d7c-4886-8194-d2d5d2de86a8","resolution":{"observed_at":"2026-08-11T23:49:50.228272Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.232080Z","title":"U-net: Convolutional networks for biomed- ical image segmentation","venue":null,"work_id":null,"year":2015},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.232080Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:beaa52cfdab059971aba4e78396e89fd70cb482892fcd70d443c1e8b3cdc8f3c","observation_id":"d9716935-c1f1-4055-8c6d-686cfc7f74f3","resolution":{"observed_at":"2026-08-11T23:49:50.232080Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.782331Z","title":"13 Published as a conference paper at ICLR 2025 Richard Tomsett, Dan Harborne, Supriyo Chakraborty, Prudhvi Gurram, and Alun Preece","venue":null,"work_id":"430ac454-2023-4556-83bc-7f57f441b36e","year":2024},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.235795Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:299f5d88da7d13ed43b99a87e026821e8dc34babdbc7e4fe38da96117e4486fc","observation_id":"aee6471b-8488-4f5d-9d06-8a041e7d822a","resolution":{"observed_at":"2026-08-11T23:49:50.786614Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.239735Z","title":"URL https://ojs.aaai","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.239735Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:de767271c7e3bc12cbb13619b069b183cfa3fda7780fd46f2f4fe42a82465374","observation_id":"b4234a20-6d6a-4b9b-ab8b-8d302df4e979","resolution":{"observed_at":"2026-08-11T23:49:50.239735Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.665192Z","title":"17 B.2 Role of the argmax operation in HRV construction","venue":null,"work_id":"35d3d996-79e2-498c-89dd-eeea083c74f7","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.243623Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:3f05b80a047735221b539a0233755d61900e55b8b691390e856e620ad3ceaab4","observation_id":"c904da17-0cac-4b30-af6a-e1b34458bed5","resolution":{"observed_at":"2026-08-11T23:49:50.669282Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.616878Z","title":null,"venue":null,"work_id":"6e68feb1-6033-4700-af90-98d7b42fe3dd","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.259587Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:20cb308f9ff2ab749fb5fa4c303fea9327e2e96014c641df763c2005e37d4b9f","observation_id":"4e65042b-a6d6-41d2-b742-df6399353368","resolution":{"observed_at":"2026-08-11T23:49:50.620830Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.640416Z","title":"The MoRHF weakening rapidly removes concept-relevant content, whereas the LeRHF weakening either preserves the original image longer or removes irrelevant content first","venue":null,"work_id":"7e945846-639b-40fc-83ee-b7ab3d8bd665","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.251798Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:821b792ee7a3f3943a59dfeb2e94a7b2cb811087bd583798d1cbd115f2649227","observation_id":"57d8313a-7d23-441b-9904-bde3b239496b","resolution":{"observed_at":"2026-08-11T23:49:50.645382Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.545594Z","title":"Both methods are evaluated on the Color editing benchmark with SA replacement rates varying from 0.0 to 1.0","venue":null,"work_id":"32046428-6870-4a22-bd60-1a73dd7fa6ad","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.283558Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:ae4c997d4f9b02e4e4a6764d69ef5ba6874c4450a97e7ac806c4b2c989983c1a","observation_id":"ced8a51d-0000-48d6-acef-0ecbf6bdf1a9","resolution":{"observed_at":"2026-08-11T23:49:50.549896Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.593289Z","title":null,"venue":null,"work_id":"276a445e-6346-465c-9cb0-29375f098ccb","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.267392Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:bdcc4ca7f756260bcf1917cba411e9563e8946ee1b597e48c82b209f61714ef5","observation_id":"977d496b-e868-4c37-b26a-88da8ebb22fd","resolution":{"observed_at":"2026-08-11T23:49:50.597066Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.581352Z","title":"The CLIP score measures the CLIP image-text similarity between the edited image and the target prompt, assessing how well the edited image aligns with the target prompt","venue":null,"work_id":"e625952e-1cee-4210-9715-ede89fa379d1","year":2024},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.271497Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:ce4123b1e51e209daa7793209c7ff205053102ff94e5f47904b5ffa6596ec033","observation_id":"2a0b06d5-5e65-4ace-9db6-cd0ca623baaa","resolution":{"observed_at":"2026-08-11T23:49:50.585509Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.569648Z","title":"While prior works (Parmar et al., 2023; Kim et al.,","venue":null,"work_id":"f1ab8486-b35b-425b-ab4a-5b662ffbe411","year":2023},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.275368Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:ea60d6ae8dbcf6f377b2f5e4bbf771345d8082cc030f970398262db31294c9ed","observation_id":"bec48f22-2c88-4a3a-bbda-68bb9609e62e","resolution":{"observed_at":"2026-08-11T23:49:50.573526Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.557685Z","title":null,"venue":null,"work_id":"200b0bb7-043a-403a-9b42-f6e1dae347ea","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.279144Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:a7a22162f9acf002472a0f9227a214654816c639bea8b67bb4af9faeaefa9c9d","observation_id":"3ffabbd8-7881-47f2-9a67-67ffa264a760","resolution":{"observed_at":"2026-08-11T23:49:50.561425Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.533609Z","title":"34 Published as a conference paper at ICLR 2025 Figure 23: Qualitative results of image editing comparing P2P (Hertz et al.,","venue":null,"work_id":"bcf95408-22af-4bc8-8bce-3e6e53ca88f2","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.287240Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:7be21836dc78d7128dfded0489032b302605d035dc1c3cd485eeb4d4d8c49bae","observation_id":"38d2f98f-97a8-46c8-954a-2b9fdb13affd","resolution":{"observed_at":"2026-08-11T23:49:50.537698Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.521062Z","title":null,"venue":null,"work_id":"a90f34e0-736b-468b-8d30-f75f6b214747","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.291468Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:10fd57962e5b479dfd81c033e4df55e52e72d7f3613e094934af106de0b153ba","observation_id":"070311c1-4766-4fe1-a3cf-c5e9126bdade","resolution":{"observed_at":"2026-08-11T23:49:50.525315Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.495114Z","title":null,"venue":null,"work_id":"1fb35717-15a0-4302-aad3-e208b378d6d3","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.299828Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:722fb44b6c2cfd245cbbcfa399ff923214769e3da816fdb2f3713e38372d7888","observation_id":"43bcdd47-7588-4a10-a52d-faff793fce29","resolution":{"observed_at":"2026-08-11T23:49:50.499108Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.481625Z","title":null,"venue":null,"work_id":"44947662-d7d7-49a1-a824-cec8b17441af","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.303862Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:3ca3350bb8ce6b735ce45b59ac366dafdd0006ad66b21f91b631e997775b9d83","observation_id":"2ee4b9b6-9b5a-4145-a4ae-71b50a5d395f","resolution":{"observed_at":"2026-08-11T23:49:50.486695Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.453511Z","title":"We then construct HRVs individually for both the 34-concept and 35-concept sets and compare them through visualization","venue":null,"work_id":"a0aa811d-d536-4ee3-b356-7a7a3a8e6edd","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.312022Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:b5ca20188e24555d08c72db22f45c238abc9115a6eb6065ffa70fd8dcd55f4e2","observation_id":"d13fbbce-5081-4796-8e70-3dec7273f723","resolution":{"observed_at":"2026-08-11T23:49:50.459648Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.468479Z","title":null,"venue":null,"work_id":"5b1b44d6-5998-4fb3-bde4-87064552dcae","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.307973Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:09b909bb1f904f0f74cab4ce22c78507f368fe96bc97e8c80b84af79364eb238","observation_id":"05c8e535-2c5c-4e74-8987-249c0aa2f448","resolution":{"observed_at":"2026-08-11T23:49:50.472413Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.172280Z","title":"Imagenet: A large-scale hi- erarchical image database","venue":null,"work_id":null,"year":2009},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":2018,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.172280Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:130875cbef302faa606a37316a2785760b264f40e54e1e2b46220b2ab8922656","observation_id":"cfed7b2c-ce98-4317-9db4-65850c8da78e","resolution":{"observed_at":"2026-08-11T23:49:50.172280Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.203777Z","title":"https://distill.pub/2020/circuits/zoom-in","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":2020,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.203777Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:ae96b214ce6c987143fb22cc9af5d783c20e24f5384248252b0f713fb9fc9967","observation_id":"6598efbf-63fd-4e84-ae29-b8174c238272","resolution":{"observed_at":"2026-08-11T23:49:50.203777Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2212.05032","last_updated":"2023-02-28T23:46:24Z","snapshot_observed_at":"2026-08-18T16:04:10.548936Z","submitted_at":"2022-12-09T18:30:24Z","title":"Training-Free Structured Diffusion Guidance for Compositional Text-to-Image Synthesis","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2212.05032","snapshot_observed_at":"2026-08-11T23:49:50.177657Z","title":"Training-free structured diffusion guidance for compositional text-to-image synthesis","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":2021,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.177657Z"},"links":{"cited_paper":"/paper/2212.05032","citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:9f64265e20ade3a4e2900405751731e04fba103eaac89228637cbec483b47a0a","observation_id":"87bb6083-fcc9-425d-b42a-d75a154b3ec0","resolution":{"observed_at":"2026-08-11T23:49:50.177657Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.05916","last_updated":"2024-03-29T03:40:47Z","snapshot_observed_at":"2026-08-16T14:53:43.711561Z","submitted_at":"2023-10-09T17:59:04Z","title":"Interpreting CLIP's Image Representation via Text-Based Decomposition","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.05916","snapshot_observed_at":"2026-08-11T23:49:50.182217Z","title":"Interpreting clip’s image representation via text-based decomposition","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.182217Z"},"links":{"cited_paper":"/paper/2310.05916","citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:7f4945c69348ff35b3e68f1d3cb7f9529c6c1f8b90dde3d9cfada47f63ebae79","observation_id":"a7887e27-e5d4-4e47-b710-a23a34539aeb","resolution":{"observed_at":"2026-08-11T23:49:50.182217Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-11T23:49:50.840573Z","title":"Multimodal neurons in artificial neural networks","venue":null,"work_id":"a6dcff38-cddc-4ce4-baa3-e992d9011d98","year":2025},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":2023,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.186857Z"},"links":{"citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:6b968e5622677466e9154944f07bc18eeeba2814af6c216c227a1346089a6655","observation_id":"7e2ccdb6-cc52-46dc-8706-731f2356e5ca","resolution":{"observed_at":"2026-08-11T23:49:50.845753Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-20T06:33:59.587034+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2202.09778","last_updated":"2022-10-31T09:05:25Z","snapshot_observed_at":"2026-08-16T17:20:02.890207Z","submitted_at":"2022-02-20T10:37:52Z","title":"Pseudo Numerical Methods for Diffusion Models on Manifolds","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2202.09778","snapshot_observed_at":"2026-08-11T23:49:50.195319Z","title":"Pseudo numerical methods for diffusion models on manifolds","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models","version":3},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-11T23:49:50.195319Z"},"links":{"cited_paper":"/paper/2202.09778","citing_paper":"/paper/2412.02237"},"observation_digest":"sha256:6a5b707f8151cb9b015d983c917897f49cb107520936abc731bf4557e986ef99","observation_id":"076b8705-0302-40fb-9955-16b675d9d79c","resolution":{"observed_at":"2026-08-11T23:49:50.195319Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2412.02237","last_updated":"2025-02-24T14:59:37Z","latest_version":3,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-19T23:08:20.816740Z","submitted_at":"2024-12-03T08:05:56Z","title":"Cross-Attention Head Position Patterns Can Align with Human Visual Concepts in Text-to-Image Generative Models"},"reference_resolution":{"displayed":35,"state_counts":{"malformed_identifier":1,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":20,"verified_exact":0,"verified_fuzzy":14},"total_outbound_references":35},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-20T06:33:59.587034+00:00","source":"crossref"},{"observed_at":"2026-08-20T06:33:54.927442+00:00","source":"retraction_watch"}],"thesis":"As of 20 August 2026, this Paper Citation Record lists 35 of 35 outbound references and 1 inbound Pith citation observation for arXiv:2412.02237."}