{"as_of":"2026-08-08T18:59:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:22e7ed9915b31f81a7ac2b603c4d62e1d2a706c64e41e68e2be70443e0bc0fd4","coverage":[{"denominator":62,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":62,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T22:47:47.767337Z","state":"measured"},{"denominator":62,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":62,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-08T06:32:00.761636+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.15619/citation-record","integrity":"/paper/2607.15619/integrity","json":"/paper/2607.15619/citation-record.json","paper":"/paper/2607.15619"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-08-01T22:47:40.747413Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:40.747413Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:b11ea3760df4c7767710cf8584c512af4d1e5c6c0dc367759722e0a8abf16efc","observation_id":"b52500e0-0fd3-49f4-a651-743739bd83b9","resolution":{"observed_at":"2026-08-01T22:47:40.747413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:40.787270Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:40.787270Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:9118df1008776822ac337af22253006215b004476e6f63f02504d8e11214828b","observation_id":"4fcc6d1c-94df-4339-882f-5edca79cf7b9","resolution":{"observed_at":"2026-08-01T22:47:40.787270Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:40.828413Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:40.828413Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:e4faa00622e3e8f387829a0ec30513086971665d602b42e15552179807a9c6f0","observation_id":"077533a4-6821-4cc3-838b-5b611eef5741","resolution":{"observed_at":"2026-08-01T22:47:40.828413Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09568","last_updated":"2025-05-14T17:11:07Z","snapshot_observed_at":"2026-07-06T21:23:57.084147Z","submitted_at":"2025-05-14T17:11:07Z","title":"BLIP3-o: A Family of Fully Open Unified Multimodal Models-Architecture, Training and Dataset","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09568","snapshot_observed_at":"2026-08-01T22:47:40.876980Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:40.876980Z"},"links":{"cited_paper":"/paper/2505.09568","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:937812bcff53dda6bd1f9f2ac44d18630a7068222db076d4c05393d00dec2783","observation_id":"b94d6848-a1de-4a99-ab7a-674bfeb62277","resolution":{"observed_at":"2026-08-01T22:47:40.876980Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:40.938675Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:40.938675Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:0a1fb8165b3820cafb2e892ff137ec5831fd42d451b673fea52d727199e7fe13","observation_id":"1c6d0971-5ad7-45ce-babf-72e852e86e28","resolution":{"observed_at":"2026-08-01T22:47:40.938675Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2501.17811","last_updated":"2025-01-29T18:00:19Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-01-29T18:00:19Z","title":"Janus-Pro: Unified Multimodal Understanding and Generation with Data and Model Scaling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2501.17811","snapshot_observed_at":"2026-08-01T22:47:41.000810Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:41.000810Z"},"links":{"cited_paper":"/paper/2501.17811","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:f2c02b12e26708a7345cc6ec08f4eaba85deb9b51218c1ffc4133bb6943f3b6a","observation_id":"ed8bfc43-93e4-49d0-b5da-f503e0efa00c","resolution":{"observed_at":"2026-08-01T22:47:41.000810Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2510.26583","last_updated":"2025-10-30T15:11:16Z","snapshot_observed_at":"2026-08-07T15:13:13.622286Z","submitted_at":"2025-10-30T15:11:16Z","title":"Emu3.5: Native Multimodal Models are World Learners","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2510.26583","snapshot_observed_at":"2026-08-01T22:47:41.067461Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:41.067461Z"},"links":{"cited_paper":"/paper/2510.26583","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:6039740e146b82d5a8fbc39c5198a6c3f04c9656740deea3a653c2cb35e39082","observation_id":"34bac566-138c-4b8b-bdb0-dcae302bd551","resolution":{"observed_at":"2026-08-01T22:47:41.067461Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-08-01T22:47:41.240965Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:41.240965Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:76f85a47db340ca80042909bc1108d4e543aa9c7bcc42b8fae848550aadab0e0","observation_id":"a6775bf9-e09a-4b68-99a1-224fab8736a4","resolution":{"observed_at":"2026-08-01T22:47:41.240965Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:41.397257Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:41.397257Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:8d0e3adbbd23960b620ce29166332e535948987155c6f508ad199003179cef48","observation_id":"f2e59a3b-e459-4369-8572-0d5b6173cae2","resolution":{"observed_at":"2026-08-01T22:47:41.397257Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:41.534253Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:41.534253Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:7fce6fe6dda3d172b66e8d27af74c871e1407c1f297ca4960992f912ff643abf","observation_id":"09ef7544-f0f5-4fe1-acff-9b16eaac3e40","resolution":{"observed_at":"2026-08-01T22:47:41.534253Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:41.661173Z","title":"2025.Nano banana","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:41.661173Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:13f67486b6fdf72d75130fc225b7bb3e02f84097e8824780397a9cb2358b26de","observation_id":"ecf5bcc3-93e4-496f-93f6-f2c5cd0b54f9","resolution":{"observed_at":"2026-08-01T22:47:41.661173Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:41.786322Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:41.786322Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:e16f5162e61073a50c70621d37020bc0eb5d110c441dba8816db9f05e272e030","observation_id":"dc79c5d4-5cad-434a-aa70-7f4122ad716c","resolution":{"observed_at":"2026-08-01T22:47:41.786322Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:41.882973Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:41.882973Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:2fcc9ce559137312654827345beec3be3808871c329cb8459d925f592df7bf82","observation_id":"9bc1c3e5-72b6-4c22-a190-4ad19cd39a5d","resolution":{"observed_at":"2026-08-01T22:47:41.882973Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.16795","last_updated":"2025-03-21T02:14:03Z","snapshot_observed_at":"2026-08-07T16:47:42.301922Z","submitted_at":"2025-03-21T02:14:03Z","title":"DCEdit: Dual-Level Controlled Image Editing via Precisely Localized Semantics","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.16795","snapshot_observed_at":"2026-08-01T22:47:41.950648Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:41.950648Z"},"links":{"cited_paper":"/paper/2503.16795","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:6b217d571a426a202f849581bb21cc68e3278e945e20983985ff75c19ae1ffcc","observation_id":"950e6061-5514-4169-8887-f80c1d992163","resolution":{"observed_at":"2026-08-01T22:47:41.950648Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:42.065802Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:42.065802Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:0996c81ea0aa7af4a09172b3dbd8c7cf34bdeb597f80b7cbf95f2e45da0a0593","observation_id":"cf1e1d47-74b5-4006-b17e-b05e7ba06954","resolution":{"observed_at":"2026-08-01T22:47:42.065802Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:42.155357Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:42.155357Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:11850ef9abca33a55b5afb9e015d4ddbaef05afb76fe9d42cc5e88e833b45884","observation_id":"cbed3ca9-6138-4da6-9795-056938579411","resolution":{"observed_at":"2026-08-01T22:47:42.155357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:42.270341Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:42.270341Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:e12d931aaf425be5b17f655248027082cbb41959994e0567fd8df7ed9746b8f0","observation_id":"1a95e01c-9d47-4a48-99bf-2459c5471650","resolution":{"observed_at":"2026-08-01T22:47:42.270341Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:42.383827Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:42.383827Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:8b036b3908e6f30be405c9b07cf3398f5007cd48d0543948fbe1c946a9bec8cc","observation_id":"e11fb46b-6b33-4e6f-a6e2-52fe62113114","resolution":{"observed_at":"2026-08-01T22:47:42.383827Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:42.463912Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:42.463912Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:0a040ba5890ec4dc20756f252669496f5efd1219ac7a923bca8f1dda11c432ce","observation_id":"5ccd4ab5-ec16-4d38-8fef-4e4fd09770bc","resolution":{"observed_at":"2026-08-01T22:47:42.463912Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:42.566175Z","title":"2023.Ultralytics YOLO","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:42.566175Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:2a7d1df70def80c51ec9d0546d95c198b16d04a09b1f2b2e28600e04994410f3","observation_id":"9c52c7dd-1171-4c4a-8257-570e3e05b273","resolution":{"observed_at":"2026-08-01T22:47:42.566175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.09987","last_updated":"2025-08-13T17:59:28Z","snapshot_observed_at":"2026-08-06T06:04:10.094208Z","submitted_at":"2025-08-13T17:59:28Z","title":"Echo-4o: Harnessing the Power of GPT-4o Synthetic Images for Improved Image Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.09987","snapshot_observed_at":"2026-08-01T22:47:42.650721Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:42.650721Z"},"links":{"cited_paper":"/paper/2508.09987","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:1ee4f07df838474bc8561bc6dfb030f39b324251423898d04297f9ec5536fc0d","observation_id":"6d962e50-6fa4-47a8-9724-bb4ce6867b2d","resolution":{"observed_at":"2026-08-01T22:47:42.650721Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:42.727771Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:42.727771Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:a9bfb5d7ae8415a147213c5f5cbf3b1d4a39db36bfa6c3f461cdb6e090f6b444","observation_id":"042a817f-0212-4054-b9bf-a7cc697a5828","resolution":{"observed_at":"2026-08-01T22:47:42.727771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:42.840794Z","title":null,"venue":null,"work_id":null,"year":1955},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:42.840794Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:a71c35f0fa2403322ece081799902afa9fa61416720f3a05fabbf3ac57e84d49","observation_id":"edf99bab-9ef4-4f7c-a431-463a26df3d25","resolution":{"observed_at":"2026-08-01T22:47:42.840794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:42.963539Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:42.963539Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:040f9b6f42ae7218b8de70f48c18abbf86ad683d512c63455a89c7607fd7d0a9","observation_id":"61739795-c120-4626-8531-8021bc15af73","resolution":{"observed_at":"2026-08-01T22:47:42.963539Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:43.055019Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:43.055019Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:928828feeb56ce06f75a198a138a84746ab96cc8cea68f9f76d3ed2b7e11ed96","observation_id":"bf93576b-c48b-48c6-b431-581b06ee521e","resolution":{"observed_at":"2026-08-01T22:47:43.055019Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:43.139629Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:43.139629Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:1a22ee65d731d5c987b55ee515ff8defd0f545d14517fa2eda250a4a5d02e698","observation_id":"407187ec-d876-414e-a023-45f84af7a165","resolution":{"observed_at":"2026-08-01T22:47:43.139629Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.02560","last_updated":"2025-06-03T07:46:44Z","snapshot_observed_at":"2026-08-07T11:19:19.343427Z","submitted_at":"2025-06-03T07:46:44Z","title":"DCI: Dual-Conditional Inversion for Boosting Diffusion-Based Image Editing","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.02560","snapshot_observed_at":"2026-08-01T22:47:43.232282Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:43.232282Z"},"links":{"cited_paper":"/paper/2506.02560","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:edc084dd8fcdd687fbe7d2dafcc20279eaceca3cec010a1dcffcd1b5e0e78a63","observation_id":"065c57d0-28e8-440e-8a01-917b99693c73","resolution":{"observed_at":"2026-08-01T22:47:43.232282Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:43.316915Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":28,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:43.316915Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:b9fae321ccf8b4f68315e9c03a80a1e2cdef8477694a0fecb29515870bc1761e","observation_id":"3d3c4d86-9ad1-41c5-8b25-a27a1a12d8d7","resolution":{"observed_at":"2026-08-01T22:47:43.316915Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:43.428890Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":29,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:43.428890Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:3de05dbd1b0136376ee61b1e3aa1d403094a87f05af1e5b8cd62232b8950a66b","observation_id":"e2467658-0151-4829-9172-1d9788e01585","resolution":{"observed_at":"2026-08-01T22:47:43.428890Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:43.552073Z","title":null,"venue":null,"work_id":null,"year":1957},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":30,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:43.552073Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:d34d8396d7720daa360954ff2991db4ca5d40759f64fd65b4684b594e071fa04","observation_id":"eb7feb7c-08b1-4971-b2cf-254420477c89","resolution":{"observed_at":"2026-08-01T22:47:43.552073Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:43.640408Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:43.640408Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:7c49cd400d23d64001e3ce1aa3cdf73065aad14a65a6c1091917e815c81a8440","observation_id":"973ba6bc-f3c5-461a-88ec-e7fc18e7e8cb","resolution":{"observed_at":"2026-08-01T22:47:43.640408Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:43.752911Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":32,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:43.752911Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:b4a439c50e0f510517687919bbfa981fa0d8355663989944aa110780a5824333","observation_id":"e5e4a2b3-d3db-4be5-9cf1-c6b50e64968e","resolution":{"observed_at":"2026-08-01T22:47:43.752911Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.06256","last_updated":"2025-04-08T17:58:47Z","snapshot_observed_at":"2026-08-03T00:43:33.310493Z","submitted_at":"2025-04-08T17:58:47Z","title":"Transfer between Modalities with MetaQueries","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.06256","snapshot_observed_at":"2026-08-01T22:47:43.894165Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":33,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:43.894165Z"},"links":{"cited_paper":"/paper/2504.06256","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:48dc43c8317a2584d95484d0249e60a22e30a12f14130d348c8a07f285bee008","observation_id":"3b860241-614e-4453-9aad-4b6bb142bd71","resolution":{"observed_at":"2026-08-01T22:47:43.894165Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:44.050022Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":34,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:44.050022Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:39a3d64458a0de1de2780d20762445695f6c4db4c081f31b47d180948ec36767","observation_id":"35b92d38-5bf0-4b91-99d2-1bcf386335db","resolution":{"observed_at":"2026-08-01T22:47:44.050022Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:44.164238Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":35,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:44.164238Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:02ff91f619236f06395987a94f1734472b3ec8b25f1f713ca4c1dfafaf658876","observation_id":"1212d648-2b76-4fb9-abca-3ff3afa43550","resolution":{"observed_at":"2026-08-01T22:47:44.164238Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:44.326221Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":36,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:44.326221Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:02ad2d53464c0259f59cc18d32314a04e16c6c9280da3f834265ebca194abdf2","observation_id":"f8e64885-b725-4aad-8935-4ab0bfd95331","resolution":{"observed_at":"2026-08-01T22:47:44.326221Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:44.492705Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:44.492705Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:977e4510a75985d40b0c3a04de1db0c20170aade16a99a7f13bb2bfe35ca48d7","observation_id":"348654b3-5c8d-4eaf-be04-22520987eb10","resolution":{"observed_at":"2026-08-01T22:47:44.492705Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2405.09818","last_updated":"2025-03-21T05:54:00Z","snapshot_observed_at":"2026-08-07T22:11:30.869700Z","submitted_at":"2024-05-16T05:23:41Z","title":"Chameleon: Mixed-Modal Early-Fusion Foundation Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2405.09818","snapshot_observed_at":"2026-08-01T22:47:44.815480Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":38,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:44.815480Z"},"links":{"cited_paper":"/paper/2405.09818","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:56adc319e338a817e8950f3ac48c9b08646b9a5385fef5899498c965789e217a","observation_id":"c85221a3-1575-43db-bfa2-5a5cf4887f30","resolution":{"observed_at":"2026-08-01T22:47:44.815480Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:45.004171Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":39,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:45.004171Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:cddf2028288855fd394c7a77267441dcace4e54758edf2043347679ce85327e6","observation_id":"b05ce44a-bfc9-4604-9d82-035e164d54b3","resolution":{"observed_at":"2026-08-01T22:47:45.004171Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:45.104196Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":40,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:45.104196Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:bbd6a25b69ac5a9062bf38a6870bc4314877489ac31df524eb6f602555219d5b","observation_id":"4fe890ab-9392-4030-b9fd-87f86b8978c1","resolution":{"observed_at":"2026-08-01T22:47:45.104196Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:45.173574Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":41,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:45.173574Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:2ee2c3404893108868aaf4e80192dcf58e0fbb919e3e4b5be6c9df35ab13c8d1","observation_id":"d0c9de8a-a1af-4350-a91b-4a2049a8f9bc","resolution":{"observed_at":"2026-08-01T22:47:45.173574Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2409.18869","last_updated":"2024-09-27T16:06:11Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2024-09-27T16:06:11Z","title":"Emu3: Next-Token Prediction is All You Need","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2409.18869","snapshot_observed_at":"2026-08-01T22:47:45.251774Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":42,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:45.251774Z"},"links":{"cited_paper":"/paper/2409.18869","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:9193925b2689289c1d7045da395f4e4bb6c4640d6f8621300baac2628f439183","observation_id":"35989cd7-6715-445c-98c7-e98ea51c27df","resolution":{"observed_at":"2026-08-01T22:47:45.251774Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2512.07348","last_updated":"2026-04-28T10:02:14Z","snapshot_observed_at":"2026-08-06T12:32:11.849043Z","submitted_at":"2025-12-08T09:40:11Z","title":"MICo-150K: A Comprehensive Dataset Advancing Multi-Image Composition","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2512.07348","snapshot_observed_at":"2026-08-01T22:47:45.353416Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":43,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:45.353416Z"},"links":{"cited_paper":"/paper/2512.07348","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:781ad2e828f0192a777a60b0e02097a6b0d96ad2b2c66d3bb19aa7c5dc96d502","observation_id":"bf7d344f-ed09-490e-86da-f46ed959895e","resolution":{"observed_at":"2026-08-01T22:47:45.353416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:45.475400Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":44,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:45.475400Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:042331cee5c8834e45b43e3c865b312a6182b41854e5f32eca00feb558cf9f13","observation_id":"13e72f78-c262-4f79-aa67-643e498304f9","resolution":{"observed_at":"2026-08-01T22:47:45.475400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2508.02324","last_updated":"2025-08-04T11:49:20Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-08-04T11:49:20Z","title":"Qwen-Image Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2508.02324","snapshot_observed_at":"2026-08-01T22:47:45.589625Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":45,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:45.589625Z"},"links":{"cited_paper":"/paper/2508.02324","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:fae0bf0d6d5a4fb05cfa83d8ad043a81dd804184eccda21a96bf03abcf5acf2e","observation_id":"d8be5a1c-ff23-4edb-aa41-99da58d5420d","resolution":{"observed_at":"2026-08-01T22:47:45.589625Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18871","last_updated":"2026-04-21T17:32:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-23T17:38:54Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18871","snapshot_observed_at":"2026-08-01T22:47:45.667116Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":46,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:45.667116Z"},"links":{"cited_paper":"/paper/2506.18871","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:b3c74f2f0a6412203ccdb811de210c52220b15c3464524b107b10bb0dd617cf1","observation_id":"d41999ea-d1de-4e78-bd79-b5ca75223ffd","resolution":{"observed_at":"2026-08-01T22:47:45.667116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:45.815950Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":47,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:45.815950Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:cb60c469859a4900a44157a180c4fddd00cb1e595afaf8beac7936b5208467f9","observation_id":"8796376e-958c-4df0-b729-40c66cfbabd9","resolution":{"observed_at":"2026-08-01T22:47:45.815950Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:45.973794Z","title":null,"venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":48,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:45.973794Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:a3e0b03360a9d2134a5a4401a377be971bca6bf263f46c48fd0a398465669591","observation_id":"680221a5-88dd-4f91-b031-048c9b52acc3","resolution":{"observed_at":"2026-08-01T22:47:45.973794Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:46.084579Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":49,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:46.084579Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:2a34463086d4b194e1de35b9b99c7614773e06a4d6008f7260ef40bffed36901","observation_id":"efb4316c-fd4f-4ac1-ae81-dc849e63ed94","resolution":{"observed_at":"2026-08-01T22:47:46.084579Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:46.292619Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":50,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:46.292619Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:8b79a7fb5e0885f09ccb264e73f07a9d31cf816a909235f60ca27bc8a52e7875","observation_id":"4a2d0a38-2962-4aba-b5c5-694eee3baba9","resolution":{"observed_at":"2026-08-01T22:47:46.292619Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:46.195180Z","title":"InProceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:46.195180Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:45c94ca13330dc8f1b8d5daf7a6938ba26776b7aa47ea2f202c5ef9c12189845","observation_id":"941bec06-bdc5-4da9-8dc2-245e64a22714","resolution":{"observed_at":"2026-08-01T22:47:46.195180Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:46.551308Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":52,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:46.551308Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:00ef73be3d2a4b38d9f24435e749cb1b2604ed4bdda98468cadf5dbd8b2aae83","observation_id":"563f8238-a5a6-4c37-af2d-9f215c835708","resolution":{"observed_at":"2026-08-01T22:47:46.551308Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:46.431606Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":53,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:46.431606Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:636d0b45e3070fe3281ffc0357e17cc22a79bc8e0d218ac7bd1b4b7820739f1c","observation_id":"f1d6ea80-ba92-4166-9913-6a0d504d16be","resolution":{"observed_at":"2026-08-01T22:47:46.431606Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.09388","last_updated":"2025-05-14T13:41:34Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-05-14T13:41:34Z","title":"Qwen3 Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.09388","snapshot_observed_at":"2026-08-01T22:47:46.850855Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":54,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:46.850855Z"},"links":{"cited_paper":"/paper/2505.09388","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:0c3f40dade3fb2b99bf4b0ec44c033627321621df5de12a798b2e3d75f452d2f","observation_id":"3db49322-ed99-41a6-828d-3a0688333ad3","resolution":{"observed_at":"2026-08-01T22:47:46.850855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.15564","last_updated":"2025-09-22T01:24:29Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-18T15:39:15Z","title":"Show-o2: Improved Native Unified Multimodal Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.15564","snapshot_observed_at":"2026-08-01T22:47:46.690808Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":55,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:46.690808Z"},"links":{"cited_paper":"/paper/2506.15564","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:626ff651a9215f9909e164e8db1ff902358183e5e28893528ea49fd9ddf7582c","observation_id":"59e220bb-b6dd-4e22-9814-418ecb0a4218","resolution":{"observed_at":"2026-08-01T22:47:46.690808Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:47.170896Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":56,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:47.170896Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:f47acf617a45e53660fb795337a11d3f7d1cc8899d36923328ddb338d2ea1bf5","observation_id":"5692bd6b-1061-47b0-9b6b-8e6f4bbeb182","resolution":{"observed_at":"2026-08-01T22:47:47.170896Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2308.06721","last_updated":"2023-08-13T08:34:51Z","snapshot_observed_at":"2026-07-06T16:05:39.158819Z","submitted_at":"2023-08-13T08:34:51Z","title":"IP-Adapter: Text Compatible Image Prompt Adapter for Text-to-Image Diffusion Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2308.06721","snapshot_observed_at":"2026-08-01T22:47:47.008256Z","title":null,"venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":57,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:47.008256Z"},"links":{"cited_paper":"/paper/2308.06721","citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:a6c7a1281600dd9e4528864060ce9127df44c995b5807657fd681d1e439c108a","observation_id":"50fd2ede-f1f3-4de8-8772-e73648b2eab9","resolution":{"observed_at":"2026-08-01T22:47:47.008256Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:47.497415Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":58,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:47.497415Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:687123c7971471290e103b883262a1bcc2b09cc437ca7361f46cbbda97025990","observation_id":"f33c7cce-76df-4876-b452-f9b2549ef038","resolution":{"observed_at":"2026-08-01T22:47:47.497415Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:47.338245Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":59,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:47.338245Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:5401aa13a0de5421a9c7f3c770beb65adfde5cd8c03c624f31539232c077b366","observation_id":"b25fc46c-2b97-4dcb-9448-382d95a52c75","resolution":{"observed_at":"2026-08-01T22:47:47.338245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:47.657330Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":61,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:47.657330Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:9f4e523c8dc97c8f05d6a8475659ce60e8f089da9442d770ce45518f9f632661","observation_id":"f67dcbaa-6f18-4078-96f1-037e5b219993","resolution":{"observed_at":"2026-08-01T22:47:47.657330Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:47.767337Z","title":"source_description","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:47.767337Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:23d664a28e49358483ce4ad0d43c8e2e0407d7fbae6dd3ee70f1bc6f74982b95","observation_id":"2ac6d3bc-e2a8-43a6-a121-19d66f8704cd","resolution":{"observed_at":"2026-08-01T22:47:47.767337Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-01T22:47:44.653227Z","title":"InProceedings of the IEEE/CVF International Conference on Computer Vision","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling","version":2},"reference_index":2025,"source":"pdf_text","source_observed_at":"2026-08-01T22:47:44.653227Z"},"links":{"citing_paper":"/paper/2607.15619"},"observation_digest":"sha256:1584a4bed3f6da60ef506aae06ca989b52abcbe5976d6371aca356a4666ab5db","observation_id":"80d255fb-3f24-4d5d-b7eb-5103295be7f8","resolution":{"observed_at":"2026-08-01T22:47:44.653227Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.15619","last_updated":"2026-07-20T04:43:29Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-08-06T18:01:16.811025Z","submitted_at":"2026-07-17T04:35:36Z","title":"StructGen: Disambiguating Multi-Reference Image Generation via Structured Context Modeling"},"reference_resolution":{"displayed":62,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":62,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":62},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-08T06:32:00.761636+00:00","source":"crossref"},{"observed_at":"2026-08-08T06:31:55.24221+00:00","source":"retraction_watch"}],"thesis":"As of 8 August 2026, this Paper Citation Record lists 62 of 62 outbound references and 0 inbound Pith citation observations for arXiv:2607.15619."}