{"as_of":"2026-08-09T08:40:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:f1be85ed025a698a41b4630dbb21cd134589495405b402e1329fca9691f09fb9","coverage":[{"denominator":46,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":46,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T01:28:29.379249Z","state":"measured"},{"denominator":46,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":46,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.28896/citation-record","integrity":"/paper/2607.28896/integrity","json":"/paper/2607.28896/citation-record.json","paper":"/paper/2607.28896"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:24.327939Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:24.327939Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:fb6be76785522f4ea5124045d5ac866dcce2fd9b3085b3334cb7549b70b44eb0","observation_id":"88778da4-a844-46b7-9961-ff0e63170628","resolution":{"observed_at":"2026-08-03T01:28:24.327939Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:24.435044Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:24.435044Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:40aa11c39af439176c4ea972de6c3c639a31749d6722ec46c29550938265f50f","observation_id":"7cff9aed-c59a-4351-9a3a-34298e736675","resolution":{"observed_at":"2026-08-03T01:28:24.435044Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:24.585293Z","title":"and Liu, Jian and Kong, Qiuqiang , howpublished =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:24.585293Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:889a4f96b6e0039efc6c3db5abe941aafad62e04818b30b954a516bcd811ae76","observation_id":"ec09bbea-de0a-4dc6-a1a7-02a225e0d87f","resolution":{"observed_at":"2026-08-03T01:28:24.585293Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:24.724542Z","title":"Proceedings of the Fourteenth International Conference on Learning Representations (ICLR) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:24.724542Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:338c987dc839e790f920fc7b69d2242fd01fd8d791a1eee0c5dc44f44b9c272b","observation_id":"862be366-3952-4943-9cc5-0bb0d0bca8fb","resolution":{"observed_at":"2026-08-03T01:28:24.724542Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:24.810855Z","title":"and Sakshi, S","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:24.810855Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:6134b0afb99072e56a85960e5c17d015c9ca80836a70fdae618cf7bb10770bfb","observation_id":"4c0a4381-7227-466e-85e7-7985685c7279","resolution":{"observed_at":"2026-08-03T01:28:24.810855Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:24.877421Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:24.877421Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:b037fcb1a61f688b59dc8300b88ce818e6e943b54c09a1418518069dbb66d0d2","observation_id":"316f35b7-a1a9-49c5-beab-d08d63709b8c","resolution":{"observed_at":"2026-08-03T01:28:24.877421Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:24.986788Z","title":"2026 , url =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:24.986788Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:be8ffa82a1121f3833e997e59cc1c2ba5f26dccc52ae88ca4b3a8dbbb782998b","observation_id":"aa204545-a20e-4b85-87e0-e3dcebdd62ef","resolution":{"observed_at":"2026-08-03T01:28:24.986788Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:25.083126Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:25.083126Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:0f3d2b98c0ec65b4adee7a2b695e564eb393a16497a8e6b2587d2e2e4ce0bfb7","observation_id":"f17e5144-0528-477e-bd83-9f58fb59e37a","resolution":{"observed_at":"2026-08-03T01:28:25.083126Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:25.195905Z","title":"2026 , doi =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:25.195905Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:d8ee44f4d1951a658ffdd055a737dcbaa99cb7b31b7dcd96cc7d6ea7afdca4f1","observation_id":"9f6abf03-361c-4e45-a222-40ec4c6412bc","resolution":{"observed_at":"2026-08-03T01:28:25.195905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:25.301255Z","title":"2025 , doi =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:25.301255Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:03cea4cfdb3107ec013f3f4cfc7dbca8adefbec2f9aeafa45fdd4aff23e5c6da","observation_id":"2d3f9272-4bd6-4e81-bee4-8a19a9404c4c","resolution":{"observed_at":"2026-08-03T01:28:25.301255Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.01804","last_updated":"2026-06-03T03:45:51Z","snapshot_observed_at":"2026-08-02T05:33:25.305210Z","submitted_at":"2026-06-01T07:21:02Z","title":"SpeechEditBench: A Bilingual Multi-Attribute Benchmark for Instruction-Guided Speech Editing","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.01804","snapshot_observed_at":"2026-08-03T01:28:25.427320Z","title":"2606.01804 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:25.427320Z"},"links":{"cited_paper":"/paper/2606.01804","citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:21f97b1bd018c86486dd9ba4da8626257f1bcb3f51e9cf9379eaab97c3e96482","observation_id":"309978da-38c1-4a03-aa81-7b013dd50e5e","resolution":{"observed_at":"2026-08-03T01:28:25.427320Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:25.598432Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:25.598432Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:e58e865c305c8a94456c26884b8a428724b7a74395a057adb7419da1f7c2dc64","observation_id":"9c6b981d-ce21-4ecd-97f9-dc3f270019fa","resolution":{"observed_at":"2026-08-03T01:28:25.598432Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:25.727829Z","title":"2023 , url =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:25.727829Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:97b5f0315e699e570b072b81fe384babcc8a4ece3877f9acebbbdc9839b0ea2b","observation_id":"8651c4b8-4866-40c8-978b-0c6d053af17d","resolution":{"observed_at":"2026-08-03T01:28:25.727829Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:25.920329Z","title":"Zero-Shot Unsupervised and Text-Based Audio Editing Using","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:25.920329Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:bb6b19b7646ef5b4354cfff9c409d48e2f60e314c8b531cea4aa7bff098200a5","observation_id":"a20fc9e2-1513-4887-8969-85db31983bd4","resolution":{"observed_at":"2026-08-03T01:28:25.920329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:26.045796Z","title":"2026 , url =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:26.045796Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:4c1635ebfbd771c8e60b46c5516866ad6c50954a6803e1dec36e73d4be33b916","observation_id":"c1d9c534-216a-4fca-a6ef-108a9ce84b21","resolution":{"observed_at":"2026-08-03T01:28:26.045796Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:26.172711Z","title":"2512.17196 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:26.172711Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:4fe806802d17d32abfaaedf03e066ebf237204e67a135adaf760c12a2defce8d","observation_id":"73f4cd26-d8a4-456d-93ba-62883fb576c2","resolution":{"observed_at":"2026-08-03T01:28:26.172711Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2505.10483","last_updated":"2025-05-15T16:34:50Z","snapshot_observed_at":"2026-08-07T15:44:59.844883Z","submitted_at":"2025-05-15T16:34:50Z","title":"UniEval: Unified Holistic Evaluation for Unified Multimodal Understanding and Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2505.10483","snapshot_observed_at":"2026-08-03T01:28:26.336885Z","title":"2505.10483 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:26.336885Z"},"links":{"cited_paper":"/paper/2505.10483","citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:83e5590be5fb5a116aad6e513bb778a6448fa10dfc28551dcab3a916a46bd724","observation_id":"3da7c09e-3dcd-4888-9e32-830b26ec1130","resolution":{"observed_at":"2026-08-03T01:28:26.336885Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:26.447627Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:26.447627Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:fc39c62c392004272fd15e2963c128ab7c42bd707d75f1e84a450d21fc50b3a0","observation_id":"f9f89132-0dd5-481c-84c2-33fe0d404454","resolution":{"observed_at":"2026-08-03T01:28:26.447627Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:26.604889Z","title":"2601.14728 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:26.604889Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:b514066de97f3ec9ddfb7e7f04ee049f0a42f9e516a9a729ea57c876db726a17","observation_id":"c309c192-0e17-438a-b33d-b389b0e2d609","resolution":{"observed_at":"2026-08-03T01:28:26.604889Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:26.701947Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:26.701947Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:82362c50a8515728444380b830669bcb629afa1767995c2dce407dae2fc83c97","observation_id":"2ae4fc9c-4b66-4a87-bf01-972ca183a5ea","resolution":{"observed_at":"2026-08-03T01:28:26.701947Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:26.758570Z","title":"2602.04683 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:26.758570Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:f19f990d97c170d56b7683fb6a64aec89b74772f1e8bdd3bd823d7d569d69610","observation_id":"9948b949-1b1f-47ad-a3e0-748ed1853cc8","resolution":{"observed_at":"2026-08-03T01:28:26.758570Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:26.840329Z","title":", booktitle =","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:26.840329Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:b50a1e9f0ecd9e9d38cbbc328b134326ddb53916656ff5bbaad91765f54629a6","observation_id":"a2bdde27-4933-4392-b11a-c5defc7d08f8","resolution":{"observed_at":"2026-08-03T01:28:26.840329Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:26.916666Z","title":"2026 , url =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:26.916666Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:c4d8b4d6e4daad82423365eb8852f1fb0d359e4f60e35db84844c7126491ec9e","observation_id":"c20f7567-0273-4666-8949-1434ac2ef5ce","resolution":{"observed_at":"2026-08-03T01:28:26.916666Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:27.014391Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:27.014391Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:87ad3844e4268d15405bde047f5d9f6ceae9f9d5e95eed214d6c3122adb4aad7","observation_id":"0822bf02-8c6a-4a29-9f2e-f79a8f0385ac","resolution":{"observed_at":"2026-08-03T01:28:27.014391Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:27.086532Z","title":"2026 , url =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:27.086532Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:ef4a95a1cc39770edd88822eb079900514f20e38202aa723da66e9c3ecc08702","observation_id":"721cbb12-663a-4a74-a038-1e7cf8643e2b","resolution":{"observed_at":"2026-08-03T01:28:27.086532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:27.207762Z","title":"Unified-","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:27.207762Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:14cffeb4932e140d0bc68472c775e5e9d22ccfd10ba005a44c213bbaff7c8546","observation_id":"0bc80471-b62a-40b1-9211-90d02ef844ad","resolution":{"observed_at":"2026-08-03T01:28:27.207762Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-08-03T01:28:27.339215Z","title":"2509.17765 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:27.339215Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:a02beed1acd0a905dbd53852d7aeb4fd834d5fbde0034bf4e029dedf42ca930d","observation_id":"e771f43b-319a-4f93-88f7-9c5759f3c502","resolution":{"observed_at":"2026-08-03T01:28:27.339215Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2503.20215","last_updated":"2025-03-26T04:17:55Z","snapshot_observed_at":"2026-08-06T08:46:20.194739Z","submitted_at":"2025-03-26T04:17:55Z","title":"Qwen2.5-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2503.20215","snapshot_observed_at":"2026-08-03T01:28:27.460473Z","title":"2503.20215 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:27.460473Z"},"links":{"cited_paper":"/paper/2503.20215","citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:1325034813aa06967a1252c3781fa5dea3c1e3df9e31a3263ed9fb56205c5e5e","observation_id":"c3879423-7c55-4dde-a4db-f3ff488ce17e","resolution":{"observed_at":"2026-08-03T01:28:27.460473Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2412.06660","last_updated":"2024-12-09T16:59:35Z","snapshot_observed_at":"2026-08-03T13:30:52.953694Z","submitted_at":"2024-12-09T16:59:35Z","title":"MuMu-LLaMA: Multi-modal Music Understanding and Generation via Large Language Models","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.06660","snapshot_observed_at":"2026-08-03T01:28:27.544162Z","title":"2412.06660 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:27.544162Z"},"links":{"cited_paper":"/paper/2412.06660","citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:5b42d11a458bb817b8f9c50358de27896aaae5e199c9fa249e871b307a33124f","observation_id":"4bb19c6a-ee30-4b9a-9400-4353f2b0f2dd","resolution":{"observed_at":"2026-08-03T01:28:27.544162Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:27.713530Z","title":"2026 , url =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:27.713530Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:dba1a332fb8a9615db22df6e791749299c82e8a62e8ce998d79fd5cb41bc99ed","observation_id":"0d698e88-94b6-4a26-bc27-24e36d83ef47","resolution":{"observed_at":"2026-08-03T01:28:27.713530Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:27.848944Z","title":"2602.00744 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:27.848944Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:31ffd0f324a1ae64bb93f2105719f4efd877181930b62954b8a2b06372f1ea59","observation_id":"325ecd09-85bb-4b21-88f5-43c187b6d483","resolution":{"observed_at":"2026-08-03T01:28:27.848944Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2506.00045","last_updated":"2025-05-28T12:23:09Z","snapshot_observed_at":"2026-08-09T08:18:10.025134Z","submitted_at":"2025-05-28T12:23:09Z","title":"ACE-Step: A Step Towards Music Generation Foundation Model","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2506.00045","snapshot_observed_at":"2026-08-03T01:28:28.022775Z","title":"2506.00045 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:28.022775Z"},"links":{"cited_paper":"/paper/2506.00045","citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:5f748f2ba71078ead94e463359326741f5daa949221b63352c54f1c274a15e5f","observation_id":"37152fb8-a22d-4c0f-b544-e5e048dca679","resolution":{"observed_at":"2026-08-03T01:28:28.022775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:28.086357Z","title":"2511.03601 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:28.086357Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:f94e248bc71e16184945ba2870b9fcfa152ed6526cb5a3a0202143b765c07cba","observation_id":"4a0fb5fd-547d-4947-9d49-ce7aaa4dc1e3","resolution":{"observed_at":"2026-08-03T01:28:28.086357Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:28.198002Z","title":"2512.20339 , archivePrefix =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:28.198002Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:d83e00c4bcfb2a3a2d55277dc7177f0c7a4993a68d4e3f75d5a292bed82f5e1c","observation_id":"7f3e2abc-1963-4368-872c-85ea899df30e","resolution":{"observed_at":"2026-08-03T01:28:28.198002Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:28.362218Z","title":"2026 , eprint =","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:28.362218Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:8a08959abebba7b191cac535cd2db035c9ec58b61ee4e1a1ab0fd448af75cdf3","observation_id":"7869e1aa-65f3-44d9-a9e3-aad1231a87ef","resolution":{"observed_at":"2026-08-03T01:28:28.362218Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:28.539778Z","title":"Proceedings of the 40th International Conference on Machine Learning , series =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:28.539778Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:d1d56928ae0c30a70e3cc9a830c05e02e7f6eaa081bce231fbe57ff1292f738b","observation_id":"5224c740-d89a-415b-bf4f-09937a132cec","resolution":{"observed_at":"2026-08-03T01:28:28.539778Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:28.601700Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:28.601700Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:7ed7051f2f3a222f9f5b45aca49f3837a7d52300644d9c70affa45a9c9c923e5","observation_id":"359afa2a-1e2e-4939-a3c1-bf37064233ef","resolution":{"observed_at":"2026-08-03T01:28:28.601700Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:28.669311Z","title":null,"venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:28.669311Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:447616e330d7d6f81dc374bb0cd9873b8049f4ffdfc8e808aa9b5b7649ceca9e","observation_id":"ec0a4468-48a7-42bf-bb8a-dd21a2c0ea64","resolution":{"observed_at":"2026-08-03T01:28:28.669311Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:28.734545Z","title":"IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages =","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:28.734545Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:14d130c747eb0932077cea34fb57ae0996a8234947bda2134678eb006ccec559","observation_id":"864e9ca7-d123-40ef-8c2d-d9b9d2e0819d","resolution":{"observed_at":"2026-08-03T01:28:28.734545Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:28.838400Z","title":null,"venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:28.838400Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:8e6c7761f07cbaca92f02920aa1bad6db61f75f4bea5a437a52774a50029fe41","observation_id":"1a42a9dd-483e-4e3e-a420-a4853164a54e","resolution":{"observed_at":"2026-08-03T01:28:28.838400Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:28.948117Z","title":"IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:28.948117Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:3d45792b0d9cb84c74d60adaf3b601dce9d371751742d16c46858a75f18f356b","observation_id":"980ab1bf-3a8e-41a6-a491-6cf8a96b54f7","resolution":{"observed_at":"2026-08-03T01:28:28.948117Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:29.083274Z","title":"Advances in Neural Information Processing Systems 36 (NeurIPS) , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:29.083274Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:ee282a63563a6f6ddd87bb1ec349b440186e91e80bdfa947fdd85d73e95ee145","observation_id":"fb164fcb-efac-4d03-816e-0aaafb4fb72c","resolution":{"observed_at":"2026-08-03T01:28:29.083274Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:29.132744Z","title":", booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:29.132744Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:00fb7e4ecd10b4b6cd4e02aa9982f61591535bdd9af63c67a467d1e455cb0f0f","observation_id":"b9da4d28-4c59-4018-8741-b0f1d5ffd242","resolution":{"observed_at":"2026-08-03T01:28:29.132744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:29.233771Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:29.233771Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:246365942479da1e1bd17f8766573d28fd8397920b62d10e3eed8ee91f7e6e23","observation_id":"762fcc0a-3d16-4c9b-8e88-c2442c564140","resolution":{"observed_at":"2026-08-03T01:28:29.233771Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:29.317101Z","title":"and Zhang, Hao and Stoica, Ion , booktitle =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:29.317101Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:d93219272438d4c55efbf40160841ef0d5ebb4f2b5f754d492bc053cf6e27a3b","observation_id":"ec60b3cd-cb93-4934-a22b-143c05695d2c","resolution":{"observed_at":"2026-08-03T01:28:29.317101Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T01:28:29.379249Z","title":"2025 , url =","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-03T01:28:29.379249Z"},"links":{"citing_paper":"/paper/2607.28896"},"observation_digest":"sha256:65a99326932c73d6966bb2ab74960022e6f03409b5292389850472a8cd7e8bbf","observation_id":"b5047c42-4cf9-4840-9ef4-319d2dfc972b","resolution":{"observed_at":"2026-08-03T01:28:29.379249Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.28896","last_updated":"2026-07-30T23:28:11Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-08T00:26:01.747407Z","submitted_at":"2026-07-30T23:28:11Z","title":"TORUS: A Test of Rendering-Understanding Self-Coherence for Unified Audio Models"},"reference_resolution":{"displayed":46,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":46,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":46},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 9 August 2026, this Paper Citation Record lists 46 of 46 outbound references and 0 inbound Pith citation observations for arXiv:2607.28896."}