{"as_of":"2026-08-06T13:49:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:494e4ec19870ead6f30b7d567f796976efea3b860c8a1bfb1c60540c4c4d4406","coverage":[{"denominator":40,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":40,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-11T11:50:26.030339Z","state":"measured"},{"denominator":40,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":40,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2606.00477/citation-record","integrity":"/paper/2606.00477/integrity","json":"/paper/2606.00477/citation-record.json","paper":"/paper/2606.00477"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":"10.18653/v1/k17-1034","metadata_source":"openalex","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Zero-Shot Relation Extraction via Reading Comprehension","venue":null,"work_id":"134b3e88-4ecf-4894-923e-fceefb5d0d38","year":2026},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:063bcabb363f0a93a83a6a59c257b8b182b1e588b42d6c4dc9e67a4954fd3793","observation_id":"e1e18169-dbf6-4449-bdc0-900dd8aa025f","resolution":{"observed_at":"2026-06-28T19:22:34.111364Z","resolver_source":"doi","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-05-23T19:23:00.880978+00:00","source":"crossref_status_cache"},{"observed_at":"2026-05-23T19:23:00.880978+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"emnlp-main.183/","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:dc0452f5fdfc1e8a16a93532d40470be6c909e5f5d84fe3f419c319ff1b73151","observation_id":"2f0be36c-db9a-41ce-9cbe-c60b128ba46d","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"1070.2023","doi":"10.1109/iccv51070.2023","metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"In: 2023 IEEE/CVF International Conference on Computer Vision (ICCV)","venue":null,"work_id":"b8a8bb9e-1d31-40e2-9cab-ae21e338dde6","year":2023},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:0dc5c07e7bb0bd45095cd46b9f887808500ab1443f38a0dac12f9985dbc98e8a","observation_id":"66cccf7d-2682-408d-84c7-bacfff6b6a64","resolution":{"observed_at":"2026-06-28T19:22:34.106069Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-07-11T15:53:34.217176+00:00","source":"crossref_status_cache"},{"observed_at":"2026-07-11T15:53:34.217176+00:00","source":"openalex_status_cache"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2605.15864","last_updated":"2026-05-26T23:36:09Z","snapshot_observed_at":"2026-08-02T22:36:43.174236Z","submitted_at":"2026-05-15T11:31:14Z","title":"Are VLMs Seeing or Just Saying? Uncovering the Illusion of Visual Re-examination","version":2},"cited_work":{"arxiv_id":"2605.15864","doi":"10.1109/cvpr52733.2024.00914","metadata_source":"pith","pith_arxiv_id":"2605.15864","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Are VLMs Seeing or Just Saying? Uncovering the Illusion of Visual Re-examination","venue":"cs.CV","work_id":"6d507602-6e66-4557-ace5-42ce9e1c2307","year":2026},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T11:50:26.030339Z"},"links":{"cited_paper":"/paper/2605.15864","citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:a9c4d4b5d3b55288d9bfa68bb555046670991365c7a3aba8fe9aa17e6aa96b33","observation_id":"cd5e89f0-39e8-4126-a97f-49927821b9aa","resolution":{"observed_at":"2026-06-28T19:22:34.109172Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2408.11039","last_updated":"2024-08-20T17:48:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-08-20T17:48:20Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","version":1},"cited_work":{"arxiv_id":"2408.11039","doi":"10.48550/arxiv.2408.11039","metadata_source":"pith","pith_arxiv_id":"2408.11039","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"Transfusion: Predict the Next Token and Diffuse Images with One Multi-Modal Model","venue":"cs.AI","work_id":"c2bb4d2d-29de-4bf2-9150-3d6373ff358f","year":2024},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"cited_paper":"/paper/2408.11039","citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:42598980b00c4f4252e4c13d3a6c481a8f8920f387e088e7275d91f06c2f775f","observation_id":"d288dd59-d864-4b0b-932d-5ccb74d053a7","resolution":{"observed_at":"2026-06-28T19:22:34.699998Z","resolver_source":"local_arxiv","status":"malformed_identifier"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"The color of the tomato is","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:675595acd4075bd5474575e0057ac6d26f4be35f6bdb341d49ba4d1c3b46358e","observation_id":"d679d205-379a-4d48-956c-690889f80e14","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"The tomato has a bright blue skin","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:d2117b5a24412c5e5774bdaf9f91563215855f76bde8c7e1498dc035f8bf42de","observation_id":"6fb029f5-9e30-448e-b206-f3c891d9219e","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"The violin is made of","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:0c4beeb09661eacfb12ff7ccea1612dd2ac82ddd55cdfa9bd40cc08aef78ed64","observation_id":"3525aad3-a413-4d22-afab-f32e783c2283","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"The light passes through the transparent glass","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:3269867f8ccf88e9001c0ccaeee7e7734d427aad7d1b27bf817885d373c9ac62","observation_id":"5e7abca9-b6cb-445b-ae91-18a3b1962cfa","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"The shape of the watermelon is","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:203568c51bcdad5f185377a3cdd128daca4b6cbfa561d0e8de78a81b88962731","observation_id":"ca8c74e2-e4dd-4fb0-93fb-a0eda48aac66","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"It is shaped like a perfect cube","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:98027749f29c6e6393439ce63c8d81f344206d9e96a532d6c5797f8ab9b1d7ac","observation_id":"85e76d8f-39fa-4d7e-aff9-0a2eacad3b7b","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"The typical size of an ant is","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:96a19cee544cd8c77f8eda83a9c223029e022d4a40cd6ebd7f82edba82df8c7d","observation_id":"c3f4f62a-58e9-4ce7-98e4-8d12e42bfd14","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"Between the ant and the shoe, the larger one is","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:9e9eaa4ca3d310b526b4474b2e667f673a2e4980a0752c84dadfba0c0f3f9ec0","observation_id":"0debb3ef-9d23-47f2-a60c-b1a9e1429fed","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"The pattern on the zebra is","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:81882447568e48d197605b371f2424ace260134cd4f6b1e7de4f5eb1feffd69a","observation_id":"afeccb1a-f7b9-4f3a-8b3d-b78e5ad58eb6","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"It has black and white stripes","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:32095c09e1235dff38f24c2d999726c935cc8e5624d6022636b24a9d45d57434","observation_id":"67693810-0b16-48ec-a9a6-4d20905082e1","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:7e21ef3f4de880dea866b8c9576672f7357c26213eeecc631beace9326699550","observation_id":"63444b0a-7c58-46d6-93a8-c0c585cc69c9","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:b4f63bb002e50cfbcfb635572f99dfba6c625a2d8f093a4ea34a5910889d66fb","observation_id":"2a3a9f48-c65d-4ed8-9b47-4a2ec390c86b","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:028d48a187cd4aa28ae9fc507a4aa450d8ae36d4c506117fad7854e530ba2944","observation_id":"1d964d0a-eb14-4f62-8d27-a24aa95bf634","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:d45f40f06a5478fe8f7686c3f9041c200dff739e4d99837e0ec084bd6a56d62d","observation_id":"69e26a84-acba-4b43-9d18-22eb8dec7a20","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"this banana","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:3ff9434f0947291c9be1ec5168fb67df07d96255e6e8f1d902da32860f2abf63","observation_id":"6359d864-f3bc-442a-a879-0bd61d283e96","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"The color of the banana is","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:a5d76898de42e7e260e6ed19511dd315720a0c493a72f44ec66f944f37617d9c","observation_id":"dc77b259-e810-404d-9f71-aad11745f4d4","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"‘‘tomato sauce’’, ‘‘orange juice’’)","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:5a849a28ae1a995a87e9ae9da7d1a3fee95eae0f8571354d6296441e3f1da1c7","observation_id":"d992ce52-eb87-493c-8236-d58ee09163d8","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:cc731053d356b8684c6c515a2e16b7c2f0525a37d2c0e53bf05d133e8d4727a4","observation_id":"deda5234-cb96-469e-87c7-f5672fbb98fd","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:ecfc3e964fd999add9f1189b0f31f5dacd8edd7ba281fd51f34d0ae43bd157a6","observation_id":"ac8a8b31-20ab-4880-9d0c-e23849bd3341","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:ce2d59c482ca3128baacdc92ad8a400ea7b608f33ce2bb449c89fd470e07f2d2","observation_id":"48013fa6-4cdf-417a-afa0-a7edd262b376","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"the tomato glistening with sapphire-coloured flesh","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:a1c58af5009dd6784c08073e837f216e9eade4f178eaab7739dd42255dacfbd9","observation_id":"24e64908-8cdf-40ab-b003-ba9da90ff50c","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"20 Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:2cabc01ba7e2635a2a6102e0849ac7168f52ca0c62834a6bacdbd10a60bd1747","observation_id":"4838c38e-28fb-4d03-bead-2e06f432962f","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"What is the color of the strawberry in this image?","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:0b31867d2ef7e20567ca49413f89824eedce32c9c7e9ea7ac0db2bdc82440042","observation_id":"d2b2b845-f870-44c1-928e-95e6fd33128c","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:8bbbb825fcb22e06cbbab57c869c86ada4992b53321cb2d21cb816873e967689","observation_id":"8e044760-3e77-46b4-b014-2d223a005e51","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"- Must NOT describe the visual appearance implied by either value","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:7063e0c707cd607b40bd3bf73e2f13c99326a5bf6b275038faabecb3273fe336","observation_id":"c70730f4-f1db-4ac7-ace0-4cb0104f6a87","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:a164eddee7315d7519483bbcc0d6eb5bcab0f534bda5b18943d97e8d65a5dd8d","observation_id":"5e8105fc-3239-402b-b0bf-964149ec2f34","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"entity\":","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:b9f7fd150180f5258c0c307ff9a9df8e1ba9c5c0361cf0e1d2e417eccd9b2ac8","observation_id":"cba58704-3a37-488f-ba83-21230d92303f","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"A professional photo of \\{subject\\} at his workplace engaged in his domain of activity","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:5ef43d1e0858ce661a47223e29f5578cef21f255da0b1ad043523b2b15e8924f","observation_id":"4de01df8-38d5-4892-b8ec-9968d6093dd8","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"The logo on the motorcycle must read ’Porsche’","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:39e51b8f47f1ffc23493956d579c0841dde768f2a420c1a3b623b99e2ec91bd6","observation_id":"991b9bd6-37a0-454b-a9b4-77e0d0e34910","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"The person in the portrait must be identifiable as Humza Yousaf","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:af5b4ec7d6c6f990aed1868382c9bb0ef61b87d7d124c19153cd11d6cbde0fdc","observation_id":"ba11032c-a590-47bb-b5ff-f8ba15ec6d1a","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"the person in the portrait","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:27312ddf264ef1a6aef7e087cd12aff377284cb9ff05b8890cf4ad7301f65289","observation_id":"ac17b767-137b-40bf-bf88-17077e60fdf5","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"are dropped downstream. === OUTPUT (return ONLY this JSON object) === \\{ 23 Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:43bc06d8ab7173db96de0299dba6595edd18467164e9050e61bb60ae9953b551","observation_id":"cad77ca9-b327-4760-a68d-f898b858ee44","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:5b3bae69d02ed96e9010e3b16e73d41b915a74f8e01c05e507722a7f8e617807","observation_id":"4d710dda-1f8e-4082-85c6-bba17fd6460f","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"must be X","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:5d356d35e17c9be9381fceb4c3956850d3c2b96b93b245a34b1acb5d4ea5e804","observation_id":"7182d6b0-90f1-42a5-b8f3-33fa8061bac8","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-28T19:15:58.940960Z","title":"observation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs","version":1},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-06-28T19:15:58.940960Z"},"links":{"citing_paper":"/paper/2606.00477"},"observation_digest":"sha256:4540f48c982c82e8917748c55c9e9cdcdda6592a77bc9fbb976c5ce68d37d8cf","observation_id":"1e2f1082-6a32-40c5-a019-1f274a1340ab","resolution":{"observed_at":"2026-06-28T19:15:58.940960Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.00477","last_updated":"2026-05-30T02:09:37Z","latest_version":1,"primary_category":"cs.CL","snapshot_observed_at":"2026-07-06T23:41:10.825760Z","submitted_at":"2026-05-30T02:09:37Z","title":"Do Text Edits Generalize to Visual Generation? Benchmarking Cross-Modal Knowledge Editing in UMMs"},"reference_resolution":{"displayed":40,"state_counts":{"malformed_identifier":1,"metadata_mismatch":3,"parse_uncertain":0,"unresolved":36,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":40},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 40 of 40 outbound references and 0 inbound Pith citation observations for arXiv:2606.00477."}