{"as_of":"2026-08-11T09:08:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:78054febbefbfd9ab0ca545d42fc9914b400ee93276338089a33cc01d5392089","coverage":[{"denominator":26,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":26,"source":"paper_references, paper_reference_links","source_observed_at":"2026-07-14T15:29:14.328745Z","state":"measured"},{"denominator":26,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":26,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-11T06:34:44.6726+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.08765/citation-record","integrity":"/paper/2607.08765/integrity","json":"/paper/2607.08765/citation-record.json","paper":"/paper/2607.08765"},"outbound":[{"citation":{"cited_paper":{"arxiv_id":"2511.21631","last_updated":"2025-11-27T12:16:54Z","snapshot_observed_at":"2026-07-06T22:37:03.716474Z","submitted_at":"2025-11-26T17:59:08Z","title":"Qwen3-VL Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2511.21631","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Qwen3-vl technical report","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2511.21631","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:4bfc3aa6dc97b8feec32cf1147c8fa84e06cf64b6b1dc3e56fbd41e448592394","observation_id":"b5a99d9a-d9e6-49bd-a287-8f5a9a8c7dd8","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Loosecontrol: Lifting controlnet for generalized depth conditioning","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:aee281cf0f76dad571df419156c361b8374aa6bdd5e7289a8c53332815cf0473","observation_id":"641a5f36-da02-4e81-ab43-97e94b3baf92","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Black Forest Labs","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:f53bab2c98d348dbac15c82fda78d9e95a4e596449171d97f4557722587b79bd","observation_id":"9d8e7c98-39d3-42fa-848f-a1dba4c639b8","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Angel Chang, Angela Dai, Thomas Funkhouser, Maciej Halber, Matthias Niessner, Manolis Savva, Shuran Song, Andy Zeng, and Yinda Zhang","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:192971a2866e16a272488eac4901587d304edc470ea2fb9e83e85659ccae5943","observation_id":"1b48b7ad-7540-4d41-97e2-56b41b29b817","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Hao Chen, Yuqi Hou, Chenyuan Qu, Irene Testini, Xiaohan Hong, and Jianbo Jiao","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:7332c53670d8e36776f98512464ec71228f0badde1e10bedf10818e42a852030","observation_id":"ab905c23-9f22-48ca-b4d1-828c341277f1","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.14683","last_updated":"2025-07-27T11:45:16Z","snapshot_observed_at":"2026-08-11T02:56:05.992492Z","submitted_at":"2025-05-20T17:59:30Z","title":"Emerging Properties in Unified Multimodal Pretraining","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.14683","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Emerging properties in unified multimodal pretraining.arXiv preprint arXiv:2505.14683,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2505.14683","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:bbacd4d083c3412e9d255586b712462310bf82aa53f6cee7fdaa758611675485","observation_id":"bd1a9969-48e5-4093-b1d3-68ba4edf874e","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Dit360: High-fidelity panoramic image generation via hybrid training.arXiv preprint arXiv:2510.11712,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:d920d38c85e37d1ba4eef5b8a0eac50206cf0ed68a8c1d289359cb2f26bfaf83","observation_id":"529699de-0d43-41b8-b5ee-be715c145614","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.13447","last_updated":"2025-05-19T17:59:42Z","snapshot_observed_at":"2026-08-09T12:36:49.059190Z","submitted_at":"2025-05-19T17:59:42Z","title":"Mean Flows for One-step Generative Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.13447","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Mean flows for one-step generative modeling.arXiv preprint arXiv:2505.13447,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2505.13447","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:d1b52686d96c9449aa03e6403cbc11d1fe3c655db812682ae79b249113835c89","observation_id":"8f19c390-12e1-4de0-8e60-04760d185ea7","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Nano banana","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:efddc8fc143db7d53a5e641ebc11d99d53e5036e4a14428263d97d2ca45179f9","observation_id":"7ffa78f0-b589-4b60-8c95-4d9b7749f2ef","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Unityvideo: Unified multi-modal multi-task learning for enhancing world-aware video generation.arXiv preprint arXiv:2512.07831, 2025a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:e46ca3a7ac9cbbed26654bbe42978dee699f27adc595cb9bacf0ee4238a1d5ee","observation_id":"9547670e-23e1-4f51-906e-b05a008a9039","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.03603","last_updated":"2025-03-11T08:14:25Z","snapshot_observed_at":"2026-08-03T00:44:01.942521Z","submitted_at":"2024-12-03T23:52:37Z","title":"HunyuanVideo: A Systematic Framework For Large Video Generative Models","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.03603","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Hunyuanvideo: A systematic framework for large video generative models.arXiv preprint arXiv:2412.03603,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2412.03603","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:5893d7de7e7180da207186cf925b802df71d58c60755ff77ae12e2302eb38c55","observation_id":"a30e540a-bdb3-428b-b2c3-38d85fbabc91","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Thinking with camera: A unified multimodal model for camera-centric understanding and generation.arXiv preprint arXiv:2510.08673,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:e9f0b6322211414416532b7c07dc9241a847eefaf7a43b42a46ff3843813e339","observation_id":"0bfaa171-341d-4a84-a3f1-8126741a3810","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Depth any panoramas: A foundation model for panoramic depth estimation","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:674d66e77867d666412452e10fc4ca024d2882feb950d63ab94c0f090fbdd8f6","observation_id":"1dc7cf5c-5453-4023-8983-d88914eab23f","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2210.02747","last_updated":"2023-02-08T15:46:05Z","snapshot_observed_at":"2026-08-02T18:24:58.914589Z","submitted_at":"2022-10-06T08:32:20Z","title":"Flow Matching for Generative Modeling","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2210.02747","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Flow matching for generative modeling.arXiv preprint arXiv:2210.02747,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2210.02747","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:d675fd0948eea7d07d5c6929d3c4a4bbdaa8b497afd3908d0ce5bc3bc8aa336a","observation_id":"8ed9fc5e-fb51-4af5-a36a-f67c00fb9273","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2504.17761","last_updated":"2025-07-31T05:05:45Z","snapshot_observed_at":"2026-07-06T21:14:24.007428Z","submitted_at":"2025-04-24T17:25:12Z","title":"Step1X-Edit: A Practical Framework for General Image Editing","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2504.17761","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Step1x-edit: A practical framework for general image editing","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2504.17761","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:3fc56f8e7e59338190894428afdf0365e7bb6e5c48128a9763a8ca9f2ad4f471","observation_id":"202e2816-caa6-4cc4-b25c-8f45a1e32562","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Minho Park, Taewoong Kang, Jooyeol Yun, Sungwon Hwang, and Jaegul Choo","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:39c4744f68116aac1a6d09f7087648b4683d43aa113fcd5e35c61aa95af508d5","observation_id":"3aecc7fb-7f55-40b9-a3c8-2891b4380313","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Masked depth modeling for spatial perception.arXiv preprint arXiv:2601.17895,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:6512b217b0513caa0e6969bd82961779add5a27f43f67975536680a4941e2c94","observation_id":"b4a3007e-0e4b-4fcb-9a7d-e8088f91ab30","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20314","last_updated":"2025-04-19T02:22:42Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-03-26T08:25:43Z","title":"Wan: Open and Advanced Large-Scale Video Generative Models","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20314","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Wan: Open and advanced large-scale video generative models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2503.20314","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:bebe0e7ca6c02c5d497400aa6276e1dcbf51f32fd74785d2b97f150134b75897","observation_id":"e642d2bb-8430-4ad3-ac04-e871e5b3f240","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.18871","last_updated":"2026-04-21T17:32:47Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-06-23T17:38:54Z","title":"OmniGen2: Towards Instruction-Aligned Multimodal Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.18871","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Qwen-image technical report","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2506.18871","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:fcb7e09bb63cf84a8b98f55bfbd5d103c4387896ea8dffd23765993b970ee777","observation_id":"99c72666-a016-4009-a436-18496c91dd25","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.06347","last_updated":"2023-10-10T06:32:24Z","snapshot_observed_at":"2026-08-10T21:13:08.810139Z","submitted_at":"2023-10-10T06:32:24Z","title":"JointNet: Extending Text-to-Image Diffusion for Dense Distribution Modeling","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.06347","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Jointnet: Extending text-to-image diffusion for dense distribution modeling.arXiv preprint arXiv:2310.06347, 2023a","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/2310.06347","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:eb923d4a9887c3d3a482730f73bf3229ffe58e9230e05b2372552d1358d73004","observation_id":"a5f93c06-e9d7-494b-a586-a40b9851fd21","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Inversion-based style transfer with diffusion models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:a9d6043bdca9bcd01421d3a52c4cf74134b617689b0660629e4f19365581346f","observation_id":"c15c7cc7-11bd-4ec9-bf32-6fd614e8e832","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"In contrast, the model trained with depth supervision produces more coherent depth structures and better cross-view consistency","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:b0d3bc2e2f219c0ea919374080692da18b66aea2734267510d85e5d2e0b11da9","observation_id":"fd4c6384-ad65-406f-aaa9-c97bbdd11f02","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1010.0063","last_updated":"2010-10-01T04:48:27Z","snapshot_observed_at":"2026-07-06T02:16:07.804694Z","submitted_at":"2010-10-01T04:48:27Z","title":"Oscillatory processes in solar flares","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1010.0063","snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"We use a constant learning-rate schedule with a 10% warmup (by steps) and set the training guidance scale to 1.0","venue":null,"work_id":null,"year":2048},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"cited_paper":"/paper/1010.0063","citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:0fffe2e84054c6a127d7f07a947342293f0195f74baf67d14b42358796956040","observation_id":"40a4818f-a6bd-4019-8a62-77ffa7883c60","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":null,"venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:236b2c6ac6f37af9e20d49e7337fb603fa74fbf2eeca153d40f4f2c55f426607","observation_id":"5510b9c9-8d03-4293-8ce5-25c7c7039396","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"We report CP (Content Preservation), SR (Style Resemblance), and OV (Overall Vision)","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:dbee3b480e5394f876c65c99c58d7387af2873d013d1242d6383cf53ddd8bb16","observation_id":"d62b75f5-b481-40fa-97be-5aa302e5a1d9","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-07-14T15:29:14.328745Z","title":"Across both inpainting and outpainting, our method achieves the best results on all three metrics, yielding lower LPIPS and FAED as well as higher PSNR than all baselines","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining","version":2},"reference_index":26,"source":"pdf_text","source_observed_at":"2026-07-14T15:29:14.328745Z"},"links":{"citing_paper":"/paper/2607.08765"},"observation_digest":"sha256:7875d1fa3ff396a3fbce4b21b9087d1b223e0df576ad585c3d419e00e84397c4","observation_id":"996475c3-6701-4ce9-9618-8f8b2f13ff7f","resolution":{"observed_at":"2026-07-14T15:29:14.328745Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.08765","last_updated":"2026-07-12T11:09:35Z","latest_version":2,"primary_category":"cs.CV","snapshot_observed_at":"2026-07-31T12:17:33.943364Z","submitted_at":"2026-07-09T17:59:06Z","title":"Enhancing In-context Panoramic Generation via Geometric-aware Pretraining"},"reference_resolution":{"displayed":26,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":26,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":26},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-11T06:34:44.6726+00:00","source":"crossref"},{"observed_at":"2026-08-11T06:34:36.301508+00:00","source":"retraction_watch"}],"thesis":"As of 11 August 2026, this Paper Citation Record lists 26 of 26 outbound references and 0 inbound Pith citation observations for arXiv:2607.08765."}