{"as_of":"2026-08-06T09:51:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:b305eb1bb2c223a0fd5b87881b70163ad9b9d998b2e37fee1656b99fd328fb8d","coverage":[{"denominator":47,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":47,"source":"paper_references, paper_reference_links","source_observed_at":"2026-06-27T20:48:31.993369Z","state":"measured"},{"denominator":50,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":50,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-06T06:34:29.942622+00:00","state":"measured"},{"denominator":3,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":3,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-01T10:17:23.216775Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07397","snapshot_observed_at":"2026-07-11T19:16:37.302399Z","title":"Audio-oscar: A multi-agent system for complex audio scene generation, orchestration, and refinement","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.04425","last_updated":"2026-07-05T17:37:12Z","snapshot_observed_at":"2026-08-02T02:38:06.002680Z","submitted_at":"2026-07-05T17:37:12Z","title":"UI-MOPD: Multi-Platform On-Policy Distillation for Continual GUI Agent Learning","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-07-11T19:16:37.302399Z"},"links":{"cited_paper":"/paper/2606.07397","citing_paper":"/paper/2607.04425"},"observation_digest":"sha256:79fe163fd81451a1c2fa188979ae429372f42931b8836e4ebd9ea24eb6a88c10","observation_id":"958ab685-f1ac-4763-8078-a11d6c5bfaa5","resolution":{"observed_at":"2026-07-11T19:16:37.302399Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07397","snapshot_observed_at":"2026-07-30T14:08:14.164905Z","title":"Audio-Oscar: A multi-agent system for complex audio scene generation, orchestration, and refinement.arXiv preprint arXiv:2606.07397, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27011","last_updated":"2026-07-30T08:12:52Z","snapshot_observed_at":"2026-08-04T22:37:07.722518Z","submitted_at":"2026-07-29T15:06:58Z","title":"Qwen-Audio-3.0-Gen-Preview Technical Report","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-07-30T14:08:14.164905Z"},"links":{"cited_paper":"/paper/2606.07397","citing_paper":"/paper/2607.27011"},"observation_digest":"sha256:17bfb38dce14ffecd2a4e3e5c4d9d11728bdec96d458e822fc89f6e106dda002","observation_id":"10bec60b-9b26-4209-867c-04f973a8710a","resolution":{"observed_at":"2026-07-30T14:08:14.164905Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2606.07397","snapshot_observed_at":"2026-08-01T10:17:23.216775Z","title":"Audio-Oscar: A multi-agent system for complex audio scene generation, orchestration, and refinement.arXiv preprint arXiv:2606.07397, 2026","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.27011","last_updated":"2026-07-30T08:12:52Z","snapshot_observed_at":"2026-08-04T22:37:07.722518Z","submitted_at":"2026-07-29T15:06:58Z","title":"Qwen-Audio-3.0-Gen-Preview Technical Report","version":2},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-01T10:17:23.216775Z"},"links":{"cited_paper":"/paper/2606.07397","citing_paper":"/paper/2607.27011"},"observation_digest":"sha256:ad8626dcec823b4462b890fca07e37972ddc35afc929140c0d347f09a5e68213","observation_id":"50fc7bfc-07bd-404b-898d-d6bcd9e6194d","resolution":{"observed_at":"2026-08-01T10:17:23.216775Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2606.07397/citation-record","integrity":"/paper/2606.07397/integrity","json":"/paper/2606.07397/citation-record.json","paper":"/paper/2606.07397"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":1,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:a08dc1ff54d42b96535053907c79a60287a2931ae9e70bfdc8a2d3460310a577","observation_id":"6eccd1fb-744d-4b3b-b971-69b3d72a9a67","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"Proceedings of the 63rd Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers) , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":2,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:1382abe73e56568a61432c1603d2c195aec08d837b32909a7252c34cda7b9bfe","observation_id":"6a597279-e7c2-451c-97fb-112279919643","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":3,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:2608cb4a365d4578c628c9dbf0e83908373e2f9a17874d053a3eb0dc53911054","observation_id":"08adc149-28c7-4a8d-9954-9afa3290b0ff","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":4,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:ec828b4b69f51adc6a026e5d0d92b941359c2aece5a4c27d739ed94cc408d69f","observation_id":"443e1c27-6712-4bc5-8508-b15c97f6af3a","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":5,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:c0022e53c458e1ac2d3745c788b3aacb615e157d982a8554222981f1d604b0e5","observation_id":"70dd60c0-10ea-4f72-a2b3-a9e274e8d68f","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"IEEE/ACM Transactions on Audio, Speech, and Language Processing , volume=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":6,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:da068d30323f121ecf352abbb862da694ce3a8386e85bd27cc7adba2c0981d60","observation_id":"2fe84ba7-0c75-4a91-968c-57377ec6c8da","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"Proceedings of the Computer Vision and Pattern Recognition Conference , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":7,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:604799453d92a352d4e08f7750926d1bc24f91ec1bd1ad5fed4ab63ed0459a25","observation_id":"d93626fd-0d48-4e9c-afbe-d5b1d44ed795","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2508.06098","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-04T07:49:39.405341Z","title":"MeanAudio: Fast and faithful text-to-audio generation with mean flows","venue":null,"work_id":"0bca9067-3c78-4136-b992-ced923d3312b","year":2025},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:96f768aa8ff8e7a022df99e5fdfc50f27c2ab4ff926c110badd05df525a7b259","observation_id":"b66debf8-de8b-4c38-8522-34a942964ba6","resolution":{"observed_at":"2026-07-02T20:17:21.367167Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"ICASSP 2025-2025 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":9,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:0bed084a2ed743af93b7681c1b2641fbee62ecb19d17155f652ced1955b50df8","observation_id":"2ef7de1e-694c-4a34-a199-e4067e43631d","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":10,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:81aae7e0fadef009496b7b185ed53bc16e96b466385ba920d0552650f73f5dda","observation_id":"9aba2350-ffb7-4105-b507-977c59ce81b4","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:12905b44e58557c27013ec22c7092eeeaeae950ccaed4859df992d8e0b2cb5b0","observation_id":"1494bd76-2a61-442b-8316-8cea57444129","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":12,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:ac022b1d65edbdc35bdda8d7b68fd1f805595be8991d9b8bcec5154cea72f3a4","observation_id":"bfc67e76-442c-4789-aa95-3131fd3acfd6","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":13,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:68b4b69fd0167bdb2fe89b68e67c0608f06da6ebfcec46c646553ea875f89e60","observation_id":"c1b44075-44b7-4dcb-ad11-f222fb871336","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"Advances in neural information processing systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":14,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:d99d1394c50a61abc043aaa886bf4e5ba518e173bed900a5a513b63b15bae84d","observation_id":"aeba4eee-8caa-4358-b762-04bb71b5c8d2","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2502.13128","last_updated":"2025-05-30T06:59:18Z","snapshot_observed_at":"2026-08-05T05:30:50.545455Z","submitted_at":"2025-02-18T18:52:21Z","title":"SongGen: A Single Stage Auto-regressive Transformer for Text-to-Song Generation","version":2},"cited_work":{"arxiv_id":"2502.13128","doi":null,"metadata_source":"pith","pith_arxiv_id":"2502.13128","snapshot_observed_at":"2026-07-09T22:26:37.236016Z","title":"SongGen: A Single Stage Auto-regressive Transformer for Text-to-Song Generation","venue":"cs.SD","work_id":"2f7deb23-326a-4caf-bbd6-544c5769f57f","year":2025},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":15,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"cited_paper":"/paper/2502.13128","citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:f1b8336dfe8c21726e6c043414c07ba8c07009981c25fa0613664e81030119b2","observation_id":"09a156e4-381f-45e3-9a1b-c9596c18a95c","resolution":{"observed_at":"2026-07-02T20:17:21.366562Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":"2602.00744","doi":null,"metadata_source":"arxiv_reference","pith_arxiv_id":null,"snapshot_observed_at":"2026-07-10T06:06:50.523106Z","title":"ACE-Step 1.5: Pushing the boundaries of open-source music generation","venue":null,"work_id":"4d13f3ca-1cdd-4a87-8b3e-6faf7d71bdcc","year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":16,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:5486e25742895704def8a1ede79c823567c538a1ccfde4237b0845b3768208db","observation_id":"6e50b170-b3ee-4bb0-89fd-146dd9b8017e","resolution":{"observed_at":"2026-07-02T20:17:21.364622Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"GitHub , year =","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":17,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:721b7a206543a917f88bbde08469a8baaa9e8a05aa784ec1d089e111f30cc7bf","observation_id":"9c8da254-9096-40f1-9551-ffcbb33cd670","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":18,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:713d052e1a397a72096f42dfa8cf442ec5eea71cab8a8b05a84a847f03f4ef63","observation_id":"f4c2023f-7764-4278-a8c2-241e761f3851","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":19,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:4fe3e5b5508ee4a9fc4aa1f53a8e418eb0f8c88bb5b52535793293902c6e1c5a","observation_id":"44764b64-4381-4b51-b93f-09f4afb7ec6f","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":20,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:41543a04ff7ea49522fc4fc34f3c9963197451b011a0a434c536197d14018e91","observation_id":"8c10791e-069d-4c6d-b0ac-e40417a74bcf","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2023 , html =","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":21,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:3ad0ba21d52ac5411e50d7136b4d2b8407841169a36351458ed6b11f4b0315bd","observation_id":"baeb7f7b-9f34-4c89-af61-10b669964110","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"Advances in Neural Information Processing Systems , volume=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:d33435fd47ca2185e17b55551024673f2fcc431ca298cdcf19472fd065bb2dbe","observation_id":"a5a1fcae-3b19-4240-8f91-5f3e5ffc514c","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2603.01455","last_updated":"2026-04-21T05:06:35Z","snapshot_observed_at":"2026-07-06T02:11:23.670680Z","submitted_at":"2026-03-02T05:12:45Z","title":"From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents","version":3},"cited_work":{"arxiv_id":"2603.01455","doi":null,"metadata_source":"pith","pith_arxiv_id":"2603.01455","snapshot_observed_at":"2026-07-03T10:58:03.480373Z","title":"From Verbatim to Gist: Distilling Pyramidal Multimodal Memory via Semantic Information Bottleneck for Long-Horizon Video Agents","venue":"cs.CV","work_id":"de041e69-5471-41af-ac94-cccece20ef6f","year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":23,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"cited_paper":"/paper/2603.01455","citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:06d717c6bfd2b88bdf7cff77456b71d6bd9e4980401c81f95160908aa70830a8","observation_id":"3b0736f9-0c87-4c2f-8e15-64cb654a8117","resolution":{"observed_at":"2026-07-02T20:17:21.356027Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":24,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:e3e01552b6900dc718a76536467ca333fa445877403ec4d577c47de057591f70","observation_id":"73bea5c0-a480-4ba6-9d89-64b1156b978d","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"and Wang, Wenwu , journal=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":25,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:e562ed7da54dc91bb01fbea3915b1a45b90e3edf2eeebc9c3dc794e5e5c776a2","observation_id":"cd23dd34-2880-4f54-b4b4-255b211c3517","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"Findings of the Association for Computational Linguistics: ACL 2025 , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":26,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:6a182652b27572f98348fdb4de5d6c725999461941443630cc04e38169cb5c0b","observation_id":"44cd3e95-a911-4fcf-8f7b-1424862b3c12","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"IEEE Transactions on Audio, Speech and Language Processing , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:5df0215406735f2b8d73f9032c794ca3264ee63c1a5bb58dcd4ec29f3b929b06","observation_id":"cac92e3d-0687-4b3d-80eb-9f976f589ec8","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"Proceedings of the 33rd ACM International Conference on Multimedia , pages=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":28,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:0b3ad2950ccfaf6951fddcc39ada3b8afb86249b91d85115e8242e11fd763ba5","observation_id":"3d30fda4-6dd2-413c-b9b8-7cdffb9aa7e0","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":29,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:cbfb647f2077e38e0b9dfea1ef403f56e2c179959eb48c7b840c9ae83161a5cd","observation_id":"2826d312-d1c6-4873-809f-339bcb6fa820","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"ICASSP 23 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":30,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:bb608fd6feb6b863d5681c5b31a5a9c1c9fe98826add0419c860d7b57e68a9f5","observation_id":"89ea6e13-b2d8-4f7f-846f-124b31a54c7c","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"Proceedings of the ISMIR 2021 Workshop on Music Source Separation , year=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":31,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:7124a3146780da88ac57ac34e638b4b8f4e4e9060e9b829f4ac0394c76c3298c","observation_id":"7c4dcc47-89d1-4ce6-8450-2c78968d4ec7","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":null,"venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":32,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:6a726f86a57b4ca521b880ea9578aab02ba8a20b8e5839e23e74d77d775e7582","observation_id":"11a468c3-29a7-42c5-adc3-072c136cf14d","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":33,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:b37d919a64057f79d206daef8bdb0750529461d9fc87203c86274481d75e4b62","observation_id":"e2d33aa2-6d0a-48c6-a3a9-f2502dfae25c","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2026 , eprint=","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":34,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:705041971568190edcfec2d730a7bf1cc3f0424e3d69842cccbbb26e37c2890a","observation_id":"1749e1a1-33ed-4d7c-8dff-f907db28ba6b","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"ICASSP 2025-2025 IEEE International Conference on Acoustics, Speech and Signal Processing (ICASSP) , pages=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":35,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:4098c02f0561693ffd6b1ec5673131754715ad407751cbddabcefb0245929317","observation_id":"cbfa2b2f-e63e-4991-87a6-b41050d590ab","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":36,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:9fc641b283ae9fe904b54a14d37f0d8eadda5cad343f230b401f83850fc1b479","observation_id":"670a8311-68ed-4b0f-885c-07f7f6d9cd55","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":37,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:5df92583ab626cbbb5d9e929e65b383ec28f05c1a3de5e9edb6807cf67a15dbb","observation_id":"6fc17f47-2dbe-47bb-a1ff-3fcb594835e6","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2025 , eprint=","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":38,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:9783aa2671caac0c9761e2c6f9a9b0f4261ae3b90c99291472087485ef945f32","observation_id":"1bea2f54-d98e-4164-8a05-6fc1c0827860","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2604.15804","last_updated":"2026-04-21T03:35:14Z","snapshot_observed_at":"2026-08-01T22:56:50.755050Z","submitted_at":"2026-04-17T08:05:46Z","title":"Qwen3.5-Omni Technical Report","version":2},"cited_work":{"arxiv_id":"2604.15804","doi":"10.48550/arxiv.2604.15804","metadata_source":"pith","pith_arxiv_id":"2604.15804","snapshot_observed_at":"2026-08-05T02:49:54.815029Z","title":"Qwen3.5-Omni Technical Report","venue":"cs.CL","work_id":"9d0aeac4-3b94-4a09-af62-5e32286fdf5f","year":2026},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":39,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"cited_paper":"/paper/2604.15804","citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:fb4f298436d7f99ab93a2f3b697a5148b1a759bbeed7e897c778c221e18ac259","observation_id":"0cd2a5ed-634f-412b-a887-aef32d793483","resolution":{"observed_at":"2026-07-02T20:17:21.358485Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"The Fourteenth International Conference on Learning Representations , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":40,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:da23704f9f60b5de4d9a7c1549ba30d688d26cb151ec3bece4a0b39988411415","observation_id":"20ffb20d-6971-4fc8-8e79-16c8d9346ff4","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2303.00747","last_updated":"2023-07-11T17:07:19Z","snapshot_observed_at":"2026-08-05T09:31:41.634301Z","submitted_at":"2023-03-01T18:59:13Z","title":"WhisperX: Time-Accurate Speech Transcription of Long-Form Audio","version":2},"cited_work":{"arxiv_id":"2303.00747","doi":"10.48550/arxiv.2303.00747","metadata_source":"pith","pith_arxiv_id":"2303.00747","snapshot_observed_at":"2026-08-05T02:28:24.338817Z","title":"WhisperX: Time-accurate speech transcription of long-form audio","venue":"cs.SD","work_id":"da9839e2-3c0b-4792-87a5-17cd9c608769","year":2023},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":41,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"cited_paper":"/paper/2303.00747","citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:84b9f07e9b160ea989271be5fc6a2c6608ac3a8b860c3e3f09a8dcdbaa837165","observation_id":"0043fb65-3140-4a9f-9907-e34513721799","resolution":{"observed_at":"2026-07-02T20:17:21.352979Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-06T06:34:29.942622+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":42,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:693f251e8adac82ee80ea4c52d9dcf467c86632f0925bffed44c706be29b769d","observation_id":"3e5ee223-9cfb-4f29-933b-1887eedb6b21","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2023 , pages=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":43,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:baddf3c3b63127da8f4307b4d8e6511b5d814026a4b7cfaf30fc66321df5bb13","observation_id":"c9f9e56b-31eb-4bff-be27-5d096282ee60","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":44,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:da7008ff75a7814da0f0fc1c58b66772ddb766b4bf73883593d44bc74753dcfa","observation_id":"d3c8939c-7924-4407-82b7-2a9b519c5141","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2023 , eprint=","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":45,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:8f6853e37d76d75dc2d154980573ba94136811bcc5f67f0be7708a524882a3ab","observation_id":"7fed039d-e651-4e76-a8a7-e09b04bff019","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"IEEE/ACM transactions on audio, speech, and language processing , volume=","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":46,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:89f064145bd8a53c0a0b48accc5bb611cde0fa29e1aabb135688a7eb749d0e81","observation_id":"ae1b431e-996d-4b91-b1da-6d67053287ca","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-06-27T20:48:31.993369Z","title":"2024 , eprint=","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement","version":1},"reference_index":47,"source":"arxiv_source","source_observed_at":"2026-06-27T20:48:31.993369Z"},"links":{"citing_paper":"/paper/2606.07397"},"observation_digest":"sha256:bf4263d8c17f60f326501ffe77c7b2db8d983ae469a42ce52244c6f74f1eeb11","observation_id":"97c59f76-764a-4e53-a8e0-45084a8c8018","resolution":{"observed_at":"2026-06-27T20:48:31.993369Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2606.07397","last_updated":"2026-06-05T15:38:08Z","latest_version":1,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-03T17:34:16.563583Z","submitted_at":"2026-06-05T15:38:08Z","title":"Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement"},"reference_resolution":{"displayed":47,"state_counts":{"malformed_identifier":0,"metadata_mismatch":6,"parse_uncertain":0,"unresolved":41,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":47},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-06T06:34:29.942622+00:00","source":"crossref"},{"observed_at":"2026-08-06T06:34:23.284952+00:00","source":"retraction_watch"}],"thesis":"As of 6 August 2026, this Paper Citation Record lists 47 of 47 outbound references and 3 inbound Pith citation observations for arXiv:2606.07397."}