{"as_of":"2026-08-19T23:29:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:885e0b49e224736d5ab2412a17c15441403785a009da644de8d46145de91028e","coverage":[{"denominator":48,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":48,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-15T14:42:59.915959Z","state":"measured"},{"denominator":48,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":48,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-19T06:32:44.657259+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2608.04479/citation-record","integrity":"/paper/2608.04479/integrity","json":"/paper/2608.04479/citation-record.json","paper":"/paper/2608.04479"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.656132Z","title":"Communication, Simulation, and Intelligent Agents: Implications of Personal Intelligent Machines for Medical Education","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.656132Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:d53150199a0faa57d23a7c1bcead353fee3d9100459ce60896618fe64170d858","observation_id":"d15cb8e6-3574-49f5-8dc7-55fbf515658c","resolution":{"observed_at":"2026-08-15T14:42:59.656132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.663652Z","title":"Classification Problem Solving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.663652Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:dcba14d8579783b0de68031acbe93139ad76275a37d948773320a9447fa26239","observation_id":"060ae91b-bf2a-4b4d-813b-270273f785c9","resolution":{"observed_at":"2026-08-15T14:42:59.663652Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.668388Z","title":", title =","venue":null,"work_id":null,"year":1980},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.668388Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:921e6fe4b30f07c1db7f4f246860d0b1813630adc60c348c946709e63bc2b28d","observation_id":"66fb71db-c4d2-4079-88b5-2053c2f5c5c5","resolution":{"observed_at":"2026-08-15T14:42:59.668388Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.674068Z","title":"New Ways to Make Microcircuits Smaller---Duplicate Entry","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.674068Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:87aa97c04023a69a3cc650c785a922cce5190be3adcc1326bd1000417e9ca2ce","observation_id":"983f592c-e531-40e0-8a8f-fdf33e46632d","resolution":{"observed_at":"2026-08-15T14:42:59.674068Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.679299Z","title":"Clancey and Glenn Rennels , abstract =","venue":null,"work_id":null,"year":1984},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.679299Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:4e22dedd4b74ce23cdc07bc0dba718a3f75e9907a6ef15a5be7697109282ebfa","observation_id":"a8692fe0-ddfb-4e86-9e46-7bd4e5b7da04","resolution":{"observed_at":"2026-08-15T14:42:59.679299Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.686127Z","title":"and Rennels, Glenn R","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.686127Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:8d167c5c62e8bacb7e6d7ff32b8cba5dae175cd3ce51f0259de0a0a5f45e730a","observation_id":"164270dc-3b0c-4cfc-8cf7-42ce289a9220","resolution":{"observed_at":"2026-08-15T14:42:59.686127Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.692107Z","title":"Poligon: A System for Parallel Problem Solving","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.692107Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:476956a6883cd34287659c4fd45dd5be1468830473582f9027ab69f700e94012","observation_id":"63306d40-9f4f-49ed-9d00-bc1cb2f1d6cd","resolution":{"observed_at":"2026-08-15T14:42:59.692107Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.697703Z","title":"Transfer of Rule-Based Expertise through a Tutorial Dialogue","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.697703Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:964e617ccfb10e301dfb8aec825582415567cd0564eb7bffba2dd6ba91d73531","observation_id":"230e628c-ca4c-4237-ac51-967d363ba4a6","resolution":{"observed_at":"2026-08-15T14:42:59.697703Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.704460Z","title":"The Engineering of Qualitative Models","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.704460Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:e697c4380de1200d609fbb912bb1435dec4d8aec86d4d9b5f901f576ed49875c","observation_id":"279c7688-3623-4dc4-8d9b-ceea26887f76","resolution":{"observed_at":"2026-08-15T14:42:59.704460Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.710132Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.710132Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:9abff47ca60182d6c120c2bdc7e04af2e395d221e7d249c0c70fadf8a073d450","observation_id":"f18658ce-5fde-4078-965f-8152ab565d4e","resolution":{"observed_at":"2026-08-15T14:42:59.710132Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.716175Z","title":"Pluto: The 'Other' Red Planet","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.716175Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:c18b6ec76613403d518aaaea7581ab8abab10df7f8defff1e36b1e9b9cf2b2f2","observation_id":"75bded29-4a4b-4977-b826-ffe9385f26e5","resolution":{"observed_at":"2026-08-15T14:42:59.716175Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2209.15352","last_updated":"2023-03-05T09:14:16Z","snapshot_observed_at":"2026-08-16T16:27:53.560021Z","submitted_at":"2022-09-30T10:17:05Z","title":"AudioGen: Textually Guided Audio Generation","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2209.15352","snapshot_observed_at":"2026-08-15T14:42:59.721245Z","title":"arXiv preprint arXiv:2209.15352 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.721245Z"},"links":{"cited_paper":"/paper/2209.15352","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:81ac4197c2808a2d65f2719637587d0632120273b3616d26fa7da945e11de905","observation_id":"bb6fb21a-5080-4518-a440-6a289ae14ec0","resolution":{"observed_at":"2026-08-15T14:42:59.721245Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.726548Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.726548Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:dd781e4218af634cd96b01d06a22da418ac8d41733f539aee719740cbde21bf0","observation_id":"da3dc80a-83d0-4ff5-a656-ff82e61a3780","resolution":{"observed_at":"2026-08-15T14:42:59.726548Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.732741Z","title":"International Conference on Machine Learning , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.732741Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:2f9e604fe55ab103378cab6c6b3dea3d90761fd9d09016dc7819b171218ffaa9","observation_id":"4c6c6010-c7f7-4862-a187-a42d0038ac17","resolution":{"observed_at":"2026-08-15T14:42:59.732741Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2305.18474","last_updated":"2023-05-29T10:41:28Z","snapshot_observed_at":"2026-08-16T15:28:43.775568Z","submitted_at":"2023-05-29T10:41:28Z","title":"Make-An-Audio 2: Temporal-Enhanced Text-to-Audio Generation","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2305.18474","snapshot_observed_at":"2026-08-15T14:42:59.739033Z","title":"arXiv preprint arXiv:2305.18474 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.739033Z"},"links":{"cited_paper":"/paper/2305.18474","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:d5308d15fad1358f79a5069347e25ad7ef978497dd62fba4f730282a8502235a","observation_id":"f25b6604-22f7-4015-a3de-b21aac2e9efd","resolution":{"observed_at":"2026-08-15T14:42:59.739033Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.693729Z","title":"IEEE/ACM Transactions on Audio, Speech, and Language Processing , volume=","venue":null,"work_id":"be1b45d9-fd06-4f9c-a8b0-d4a9fac08424","year":2024},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.744560Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:65ab9b10f23a1a5122b5c296b483c00542b8aa9adc0b0f48ddf71999b6d7e2b0","observation_id":"8b1aebac-cacd-4910-ab8b-7471b3acbeab","resolution":{"observed_at":"2026-08-15T14:43:00.699947Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.677253Z","title":null,"venue":null,"work_id":"dc41ea0a-bc5d-4edb-b8f2-ddb167aaf853","year":2025},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.749925Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:46d1cbe39ca3cc1ed2225ab2353f6674d8ad26f47684a7d7d5cabd5549203d34","observation_id":"59c5b839-65e6-4110-82c5-750980f88e4f","resolution":{"observed_at":"2026-08-15T14:43:00.681753Z","resolver_source":"raw_fallback","status":"unresolved"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.661119Z","title":"Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"befed844-c248-4ac1-94b4-ede7df0a58b6","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.755212Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:0738343bf162d4c35ae2bde11ad5c071c5b980f71d31eff99dc6a92c30807954","observation_id":"353c9c45-9f2c-41f2-98b1-828283940182","resolution":{"observed_at":"2026-08-15T14:43:00.665844Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.21037","last_updated":"2025-04-10T05:01:32Z","snapshot_observed_at":"2026-08-18T08:51:59.333838Z","submitted_at":"2024-12-30T16:02:44Z","title":"TangoFlux: Super Fast and Faithful Text to Audio Generation with Flow Matching and Clap-Ranked Preference Optimization","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.21037","snapshot_observed_at":"2026-08-15T14:42:59.761744Z","title":"arXiv preprint arXiv:2412.21037 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.761744Z"},"links":{"cited_paper":"/paper/2412.21037","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:10eb6645cf676feae15987678061023e601b9f30eb5b9b15f7043c6e0d6fe084","observation_id":"bd374cdc-3ac6-41b9-acb6-42e80f99e63d","resolution":{"observed_at":"2026-08-15T14:42:59.761744Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.645009Z","title":"ACM Multimedia 2024 , year=","venue":null,"work_id":"de426c32-4d6a-44c7-ac3d-baf242b0476f","year":2024},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.769162Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:556c938276d1f072ef9b6aa67bb477e0775458f7b56841d70d7bd3e0b98c46c8","observation_id":"be12a893-7597-41a8-81cc-05331229c467","resolution":{"observed_at":"2026-08-15T14:43:00.650056Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.03672","last_updated":"2026-06-02T13:56:31Z","snapshot_observed_at":"2026-08-13T19:13:53.956195Z","submitted_at":"2026-06-02T13:56:31Z","title":"Foley-Omni: A Unified Multimodal Generation Model from Task-Level Audio Synthesis to Complete Video Soundtrack Generation","version":1},"cited_work":{"arxiv_id":"2606.03672","doi":null,"metadata_source":"pith","pith_arxiv_id":"2606.03672","snapshot_observed_at":"2026-08-15T14:43:00.224264Z","title":"Foley-Omni: A Unified Multimodal Generation Model from Task-Level Audio Synthesis to Complete Video Soundtrack Generation","venue":"cs.SD","work_id":"ce6df2d6-c770-4a9c-90d7-d94b7cff65c4","year":2026},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.774584Z"},"links":{"cited_paper":"/paper/2606.03672","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:90c46696c471767dc142420e5928770b1d2a772eb2f70e43f164509383eb01cc","observation_id":"12672582-5f4b-430d-8429-91c42f95d514","resolution":{"observed_at":"2026-08-15T14:43:00.232599Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.628052Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"8d712834-964f-4e3e-a7ec-1e21c548ffa4","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.780181Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:838a1879379215f4861047a28056b067388be06003ef20bd455610778026f933","observation_id":"01f12150-bc60-43db-8e76-3f377e60480c","resolution":{"observed_at":"2026-08-15T14:43:00.633413Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.611330Z","title":"Proceedings of the IEEE/CVF Conference on Computer Vision and Pattern Recognition , pages=","venue":null,"work_id":"2b79e37b-677e-4d96-af6c-41d5a5c6d0a1","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.785728Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:50701b283f54beccf6370fed54a4a9c3e167ec2309b7e713439dc920f5a8d89e","observation_id":"57439906-f50a-4a55-a98a-a6f9783406d1","resolution":{"observed_at":"2026-08-15T14:43:00.616801Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.791463Z","title":null,"venue":null,"work_id":null,"year":2019},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.791463Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:9411c0079955fb38c3d599f62b3b8311189d4da110dc210827d5e2659b811055","observation_id":"454bb552-3881-4921-83ae-bfadff7dd372","resolution":{"observed_at":"2026-08-15T14:42:59.791463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.797817Z","title":"ICASSP 2020-2020 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.797817Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:2770200a00db6e9253e02518f10e3c4936c0ad0f1ae26f58dfde8f2dc8c69294","observation_id":"972ff5c6-baef-47a4-86bd-6f1843e28e91","resolution":{"observed_at":"2026-08-15T14:42:59.797817Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.567257Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"e8a0fbd7-c56c-45d2-84c3-adf4643d8a30","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.803865Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:1975b6b677d760c7c60e59e46c16e0b220f1f3c1d38dc6db16abab07c286fd0f","observation_id":"cd0b8e08-88ff-4e73-9d33-d1b507c1bff0","resolution":{"observed_at":"2026-08-15T14:43:00.574368Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.548279Z","title":"Proceedings of the 33rd ACM International Conference on Multimedia , pages=","venue":null,"work_id":"1b279eb7-2a63-4285-85f1-996d1a153594","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.810041Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:c773a364a8a2e8926342575ce815e762e3feafb5b58a0aaa64b79d7b793ad13e","observation_id":"5b87f002-e754-44df-a1f5-47c0a032ef23","resolution":{"observed_at":"2026-08-15T14:43:00.554011Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.528837Z","title":"Proceedings of the 2025 Conference on Empirical Methods in Natural Language Processing , pages=","venue":null,"work_id":"9b21f151-a6da-4956-8bd8-32b39a597a2b","year":2025},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.815556Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:e3e2ca51a9861ac50dff7a0fd7ecf03a2b885146d551d6e58fedf8e4d5de0778","observation_id":"18dee7ca-99b2-4f2f-9927-41d3bb166e8a","resolution":{"observed_at":"2026-08-15T14:43:00.535142Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.510070Z","title":"ICASSP 2025-2025 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":"cb869df9-229a-462a-aacf-b7f12d3da033","year":2025},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.820997Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:decc295c16aa8bf06e04fb6241e95e8b3d8605b0af7e705d5673f8ffb556be23","observation_id":"9d2ffc71-78a4-476b-b5a7-1a6f3c8f2c19","resolution":{"observed_at":"2026-08-15T14:43:00.515620Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2509.17765","last_updated":"2025-09-22T13:26:24Z","snapshot_observed_at":"2026-08-11T00:14:34.061687Z","submitted_at":"2025-09-22T13:26:24Z","title":"Qwen3-Omni Technical Report","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2509.17765","snapshot_observed_at":"2026-08-15T14:42:59.825968Z","title":"arXiv preprint arXiv:2509.17765 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.825968Z"},"links":{"cited_paper":"/paper/2509.17765","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:9974ea233c41c210a6dcebcf5474f1ec2cf0875defdc0dcca27d81483083e8b1","observation_id":"561ef328-f09d-4a9a-b038-e4d1c34d98e2","resolution":{"observed_at":"2026-08-15T14:42:59.825968Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2601.21337","last_updated":"2026-01-30T02:58:48Z","snapshot_observed_at":"2026-08-13T02:49:58.912820Z","submitted_at":"2026-01-29T06:58:13Z","title":"Qwen3-ASR Technical Report","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2601.21337","snapshot_observed_at":"2026-08-15T14:42:59.831434Z","title":"arXiv preprint arXiv:2601.21337 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.831434Z"},"links":{"cited_paper":"/paper/2601.21337","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:0c2d65c19dfa0ec26155f39b40048d86564ecfd0ff91727b7d5fdd3ce825d95a","observation_id":"e5131ab7-96a2-4ab8-a95c-599adcdea5a3","resolution":{"observed_at":"2026-08-15T14:42:59.831434Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.488346Z","title":"International Conference on Learning Representations , volume=","venue":null,"work_id":"f07ce7bd-1b7a-48d5-88c1-4faab0a03a89","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.836720Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:3cce1ce5b5dbc8b64a9bdc1f00e9a8f5a0876c32fc650ff114a64db297cf41aa","observation_id":"e0eb6d7c-dd14-4769-8780-f6618066c3d4","resolution":{"observed_at":"2026-08-15T14:43:00.494319Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.470015Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":"aad87c4d-af48-4f12-bd48-a598af2815ed","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.841951Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:048e7783f17869f58ce8597ead85e91a3e24250fdf83e9c777ce1731cb0d6017","observation_id":"e6992eb4-7dd0-4cec-a596-a95b9255cda0","resolution":{"observed_at":"2026-08-15T14:43:00.475403Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.847438Z","title":"ICASSP 2025-2025 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.847438Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:743bc516c1c4ebe258cccc182737cb4a9a50e5ebc17635fb9941f4f99821ec15","observation_id":"055853a5-dd42-44d3-a171-9ad001da119d","resolution":{"observed_at":"2026-08-15T14:42:59.847438Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2605.27838","last_updated":"2026-05-27T01:50:29Z","snapshot_observed_at":"2026-08-18T03:40:38.590853Z","submitted_at":"2026-05-27T01:50:29Z","title":"Dasheng AudioGen: A Unified Model for Generating Coherent Audio Scenes from Text","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2605.27838","snapshot_observed_at":"2026-08-15T14:42:59.853851Z","title":"arXiv preprint arXiv:2605.27838 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.853851Z"},"links":{"cited_paper":"/paper/2605.27838","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:a909bec2c881f40bdf483975cc655d859c1a594bd2985902951dc28d5a01e342","observation_id":"dcfd42c6-4d4b-4abf-99f3-63247964612c","resolution":{"observed_at":"2026-08-15T14:42:59.853851Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.442284Z","title":"2025 IEEE Automatic Speech Recognition and Understanding Workshop (ASRU) , pages=","venue":null,"work_id":"de1734ff-843d-4e26-a474-4c8520ba0b62","year":2025},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.858944Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:fd5cb5840d0ab188bb17575204d25c359e8edcb69e78a2a8f90047e8298c7cef","observation_id":"112f6344-dd12-4acd-85e0-8b9ada1b8f0f","resolution":{"observed_at":"2026-08-15T14:43:00.447483Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.424700Z","title":"ICASSP 2024-2024 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":"39a92666-7a9c-4884-bcc4-e467a5d34224","year":2024},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.863171Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:7b1ffcdf34d4ed9a1bcbb93eee1a4e1fb4d4e16e5ba4f1791cfc9df16d6e320a","observation_id":"8c92570a-3a93-4cb9-aff0-f7f1f94ebd3b","resolution":{"observed_at":"2026-08-15T14:43:00.430599Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.867436Z","title":"ICASSP 2023-2023 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.867436Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:d292cfdec429024a37ed2aa5b686481b6f8d38b4979f67ed1320c421a7c3e011","observation_id":"988dc527-b5cb-4625-bef0-46b83797b7cc","resolution":{"observed_at":"2026-08-15T14:42:59.867436Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.388759Z","title":"IEEE/ACM Transactions on Audio, Speech, and Language Processing , volume=","venue":null,"work_id":"3b024499-bca9-4d1d-9c8d-6b765ddb8b50","year":2023},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.871806Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:53f4f8c96c6f1dd9022731edd87bb62a9e9f7827f15978475d6959fa4476640c","observation_id":"0cd362f4-b975-4f5d-bbef-7d5a091936c1","resolution":{"observed_at":"2026-08-15T14:43:00.394822Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2312.15821","last_updated":"2023-12-25T22:24:49Z","snapshot_observed_at":"2026-08-17T22:52:14.678531Z","submitted_at":"2023-12-25T22:24:49Z","title":"Audiobox: Unified Audio Generation with Natural Language Prompts","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2312.15821","snapshot_observed_at":"2026-08-15T14:42:59.876083Z","title":"arXiv preprint arXiv:2312.15821 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.876083Z"},"links":{"cited_paper":"/paper/2312.15821","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:50cbbb46e45219388db36ce1a4d42fb71a5cfee443505ccc93ba9012c1aa1e5c","observation_id":"81c4d6f4-71c1-480f-bd87-420838acd450","resolution":{"observed_at":"2026-08-15T14:42:59.876083Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2310.00704","last_updated":"2024-12-10T03:17:56Z","snapshot_observed_at":"2026-08-16T14:56:06.586855Z","submitted_at":"2023-10-01T15:49:46Z","title":"UniAudio: An Audio Foundation Model Toward Universal Audio Generation","version":6},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2310.00704","snapshot_observed_at":"2026-08-15T14:42:59.881248Z","title":"arXiv preprint arXiv:2310.00704 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.881248Z"},"links":{"cited_paper":"/paper/2310.00704","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:dac4c700e47f9b4bba87fb0692f555b3b25d17a894a7024a567816d718c613f7","observation_id":"3e1be26f-d952-4e6d-8061-e815095392b2","resolution":{"observed_at":"2026-08-15T14:42:59.881248Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.367976Z","title":"Proceedings of the 31st ACM international conference on multimedia , pages=","venue":null,"work_id":"f85a34d0-70a7-48d6-b403-67292b48358d","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.886071Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:e00d2dd562ecfcf574cad4a97a173c2716b9821554e8a2b785848e0ecf310926","observation_id":"4b50d485-1483-449a-a0c5-55ae1eedd838","resolution":{"observed_at":"2026-08-15T14:43:00.374233Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.349546Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":"800b3971-e87a-4dfb-9d28-42c06bded1b1","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.890918Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:2dbf4aad6121781e41e27e821616f706a0ebacec863cdee4ab97231578e25885","observation_id":"e1b705b8-42cf-43ec-9e55-dd5961363bc7","resolution":{"observed_at":"2026-08-15T14:43:00.355547Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.328773Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":"483b49d0-fdf5-4af7-b022-1d2400f90144","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.895386Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:b222add10722ffe59bfec26f57c4942504ad3faab5c16af94105fe1699400f7e","observation_id":"bab18643-5a1b-4c94-84af-e440bb9268ed","resolution":{"observed_at":"2026-08-15T14:43:00.336682Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2412.15922","last_updated":"2026-04-08T21:03:14Z","snapshot_observed_at":"2026-08-10T11:18:08.326588Z","submitted_at":"2024-12-20T14:14:00Z","title":"RiTTA: Modeling Event Relations in Text-to-Audio Generation","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2412.15922","snapshot_observed_at":"2026-08-15T14:42:59.899997Z","title":"arXiv preprint arXiv:2412.15922 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.899997Z"},"links":{"cited_paper":"/paper/2412.15922","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:c2d91579e3ce1c1bda010f6e79258c8eddd2568ac367dcff76bd91d9e9fbaece","observation_id":"753bd65d-02ac-4e06-a3b8-f6f047d3b873","resolution":{"observed_at":"2026-08-15T14:42:59.899997Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":"raw_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:43:00.309394Z","title":"Proceedings of the AAAI Conference on Artificial Intelligence , volume=","venue":null,"work_id":"75ad56fb-94d4-4ee3-bdaa-65b72eb2ca65","year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.905695Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:af574a98039c53ec16f119a091459aedd6a688f8bdf34a9a3d81a47024bf8fd2","observation_id":"4cac88f7-d0c1-46a1-bc3f-563d71d63ac1","resolution":{"observed_at":"2026-08-15T14:43:00.315887Z","resolver_source":"raw_fallback","status":"verified_fuzzy"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-19T06:32:44.657259+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2606.03116","last_updated":"2026-06-02T04:00:32Z","snapshot_observed_at":"2026-08-15T07:01:44.048656Z","submitted_at":"2026-06-02T04:00:32Z","title":"AnyAudio-Judge: A Dynamic Rubric-Based Benchmark and Evaluator for Audio Instruction Following","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.03116","snapshot_observed_at":"2026-08-15T14:42:59.910572Z","title":"arXiv preprint arXiv:2606.03116 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.910572Z"},"links":{"cited_paper":"/paper/2606.03116","citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:039cfa4b46405dd0d1c7c7f502849f05b3430e2ddfa6519e5289e0074c63ab89","observation_id":"ee7c1ce7-5de1-45cc-8ae9-dfbadfa6cda9","resolution":{"observed_at":"2026-08-15T14:42:59.910572Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-15T14:42:59.915959Z","title":"arXiv preprint arXiv:2601.14728 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation","version":1},"reference_index":48,"source":"arxiv_source","source_observed_at":"2026-08-15T14:42:59.915959Z"},"links":{"citing_paper":"/paper/2608.04479"},"observation_digest":"sha256:c2a8f722ec11c5656554cc618e256ac37e717ee481697f20c6600b6919aa147a","observation_id":"b976ad1c-1326-48c1-abd1-caf793e58e84","resolution":{"observed_at":"2026-08-15T14:42:59.915959Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2608.04479","last_updated":"2026-08-05T06:06:54Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-19T07:42:04.360814Z","submitted_at":"2026-08-05T06:06:54Z","title":"AudioScape-TTA: A Structured Soundscape Benchmark for Fine-Grained Text-to-Audio Evaluation"},"reference_resolution":{"displayed":48,"state_counts":{"malformed_identifier":0,"metadata_mismatch":1,"parse_uncertain":0,"unresolved":29,"verified_exact":0,"verified_fuzzy":18},"total_outbound_references":48},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-19T06:32:44.657259+00:00","source":"crossref"},{"observed_at":"2026-08-19T06:32:39.956319+00:00","source":"retraction_watch"}],"thesis":"As of 19 August 2026, this Paper Citation Record lists 48 of 48 outbound references and 0 inbound Pith citation observations for arXiv:2608.04479."}