{"as_of":"2026-08-10T04:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:8c5e66343bfefb708791c11abc2e3fea9b135bd219a6c1f6605cb584e452cf72","coverage":[{"denominator":0,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":39,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":39,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-09T06:31:02.800959+00:00","state":"measured"},{"denominator":39,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":39,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-08T11:51:21.745748Z","state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"pith","source_observed_at":"2026-07-08T00:04:22.330619Z","state":"measured"}],"external_citation_measurements":[],"inbound":[{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2410.00037","last_updated":"2024-10-02T09:11:45Z","snapshot_observed_at":"2026-07-30T10:21:14.474746Z","submitted_at":"2024-09-17T17:55:39Z","title":"Moshi: a speech-text foundation model for real-time dialogue","version":2},"reference_index":27,"source":"arxiv_source","source_observed_at":"2026-05-12T08:13:21.962488Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2410.00037"},"observation_digest":"sha256:9c3b00782c7b856df7930603ce80204c9ca91c8a034568f09f8874bec32e5de3","observation_id":"df49c7b4-2911-42d5-98f0-ef4bc8acafa6","resolution":{"observed_at":"2026-05-12T08:13:22.386563Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2502.04230","last_updated":"2026-05-22T02:22:15Z","snapshot_observed_at":"2026-07-06T20:32:18.814472Z","submitted_at":"2025-02-06T17:15:08Z","title":"XAttnMark: Learning Robust Audio Watermarking with Cross-Attention","version":3},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-05-25T08:30:15.011210Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2502.04230"},"observation_digest":"sha256:2e268ed7562774839c3094b06aa04c61ec8b63aa8bdf95062af5226e0b1a757a","observation_id":"0a6df990-9100-4d81-92ea-c93bcd818a5b","resolution":{"observed_at":"2026-05-25T08:30:31.598089Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-08T11:51:21.745748Z","title":"Parker, CJ Carr, Zack Zukowski, Josiah Taylor, and Jordi Pons","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2502.07711","last_updated":"2025-02-11T17:10:31Z","snapshot_observed_at":"2026-08-09T03:28:24.877143Z","submitted_at":"2025-02-11T17:10:31Z","title":"RenderBox: Expressive Performance Rendering with Text Control","version":1},"reference_index":2022,"source":"pdf_text","source_observed_at":"2026-08-08T11:51:21.745748Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2502.07711"},"observation_digest":"sha256:d25f23974c773de4250f187ba4cf3038db44051143b123ea5f224ce0f5eb306b","observation_id":"abae9793-14be-4230-ad20-0792f6efabcf","resolution":{"observed_at":"2026-08-08T11:51:21.745748Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-07T14:22:07.358306Z","title":"Stable audio open,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.19314","last_updated":"2025-09-06T14:32:56Z","snapshot_observed_at":"2026-08-09T09:34:05.335498Z","submitted_at":"2025-05-25T21:00:48Z","title":"SoloSpeech: Enhancing Intelligibility and Quality in Target Speech Extraction through a Cascaded Generative Pipeline","version":3},"reference_index":51,"source":"pdf_text","source_observed_at":"2026-08-07T14:22:07.358306Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2505.19314"},"observation_digest":"sha256:83eefb5054e5197a07cc78e346b66e338c86e1b67a9f595f2a002900e198e3a3","observation_id":"010a6aa9-89f3-47cb-9fbb-8b2e41a8ab8f","resolution":{"observed_at":"2026-08-07T14:22:07.358306Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-07T14:00:57.121661Z","title":"Evans, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2505.20290","last_updated":"2025-06-03T22:50:28Z","snapshot_observed_at":"2026-08-09T08:53:34.877255Z","submitted_at":"2025-05-26T17:59:17Z","title":"EgoZero: Robot Learning from Smart Glasses","version":2},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-07T14:00:57.121661Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2505.20290"},"observation_digest":"sha256:064b89d78fe56d5a6c4a6e2f27f52b558c9c9b81f023a199594f47c0047c8122","observation_id":"fb01a782-6a20-4e6f-be1f-b876057d50bf","resolution":{"observed_at":"2026-08-07T14:00:57.121661Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-07T11:59:46.826653Z","title":null,"venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.00927","last_updated":"2025-06-01T09:41:56Z","snapshot_observed_at":"2026-08-08T23:02:00.996998Z","submitted_at":"2025-06-01T09:41:56Z","title":"In-the-wild Audio Spatialization with Flexible Text-guided Localization","version":1},"reference_index":8,"source":"arxiv_source","source_observed_at":"2026-08-07T11:59:46.826653Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2506.00927"},"observation_digest":"sha256:ba12e264234b3ff11af41bb5ac28138e0800c1633ede733f9a577975d80812f9","observation_id":"0695eaaf-9f11-40cb-b31a-60689505be24","resolution":{"observed_at":"2026-08-07T11:59:46.826653Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-07T00:49:43.573592Z","title":"Stable audio open,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.12573","last_updated":"2025-06-27T22:16:16Z","snapshot_observed_at":"2026-08-09T18:41:46.611854Z","submitted_at":"2025-06-14T16:58:42Z","title":"Video-Guided Text-to-Music Generation Using Public Domain Movie Collections","version":3},"reference_index":37,"source":"pdf_text","source_observed_at":"2026-08-07T00:49:43.573592Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2506.12573"},"observation_digest":"sha256:5775e38451df3b9bbe519aef86f68dfa636362a63426fa9e0cbef4d2d314b893","observation_id":"7e3009df-3e6b-43a6-a441-32a41699f533","resolution":{"observed_at":"2026-08-07T00:49:43.573592Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-06T23:21:30.605672Z","title":"Stable audio open,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2506.18488","last_updated":"2025-06-28T05:44:41Z","snapshot_observed_at":"2026-08-09T14:28:00.448846Z","submitted_at":"2025-06-23T10:42:50Z","title":"AI-Generated Song Detection via Lyrics Transcripts","version":2},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-06T23:21:30.605672Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2506.18488"},"observation_digest":"sha256:6ce0c77cb124ede9f3d14218cea24a5f275f5c9e047f184ce12ea81321cda9ea","observation_id":"92432c06-a95a-4307-8f94-eac5b511ddac","resolution":{"observed_at":"2026-08-06T23:21:30.605672Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-06T20:09:33.838638Z","title":"Stable audio open,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.03599","last_updated":"2025-07-04T14:12:19Z","snapshot_observed_at":"2026-08-09T23:41:06.010955Z","submitted_at":"2025-07-04T14:12:19Z","title":"MusGO: A Community-Driven Framework For Assessing Openness in Music-Generative AI","version":1},"reference_index":62,"source":"pdf_text","source_observed_at":"2026-08-06T20:09:33.838638Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2507.03599"},"observation_digest":"sha256:290b9ce1a9dc74440d81519f087494cb7d6566271897a1f6ac95f55e6507eacc","observation_id":"79271cda-6323-4b53-ae43-08a4a409bbc7","resolution":{"observed_at":"2026-08-06T20:09:33.838638Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-06T19:42:05.770026Z","title":"Stable audio open,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.04864","last_updated":"2025-07-07T10:46:07Z","snapshot_observed_at":"2026-08-09T16:34:16.703575Z","submitted_at":"2025-07-07T10:46:07Z","title":"Music Boomerang: Reusing Diffusion Models for Data Augmentation and Audio Manipulation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-06T19:42:05.770026Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2507.04864"},"observation_digest":"sha256:d1f9827b21a3d38ccd92292b87e7f26d51ececdcc824b61588ab88990e0f3a52","observation_id":"2acf8ad3-4c79-40d3-8278-6d2e4d1292ed","resolution":{"observed_at":"2026-08-06T19:42:05.770026Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-06T17:32:40.302149Z","title":"Stable audio open","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.10534","last_updated":"2025-07-17T18:06:25Z","snapshot_observed_at":"2026-08-09T21:36:47.447203Z","submitted_at":"2025-07-14T17:55:38Z","title":"WildFX: A DAW-Powered Pipeline for In-the-Wild Audio FX Graph Modeling","version":2},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-06T17:32:40.302149Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2507.10534"},"observation_digest":"sha256:e8c3d05e4fedab0af19af3f55d0aa916881cef2e6d908424cdb028c80c1cc698","observation_id":"40705b46-cf19-4a18-9a1b-330991371b57","resolution":{"observed_at":"2026-08-06T17:32:40.302149Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-06T13:14:37.497860Z","title":"D.; Carr, C.; Zukowski, Z.; Taylor, J.; and Pons, J","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2507.20880","last_updated":"2025-07-28T14:34:02Z","snapshot_observed_at":"2026-08-06T16:37:02.345788Z","submitted_at":"2025-07-28T14:34:02Z","title":"JAM: A Tiny Flow-based Song Generator with Fine-grained Controllability and Aesthetic Alignment","version":1},"reference_index":11,"source":"arxiv_source","source_observed_at":"2026-08-06T13:14:37.497860Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2507.20880"},"observation_digest":"sha256:e8606c33296031d27dde7779dd1ad3df47ea527e62190832be98a847c9bd8d84","observation_id":"20588f1c-a788-4721-8f1a-a3798bf2e111","resolution":{"observed_at":"2026-08-06T13:14:37.497860Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-05T14:59:36.287207Z","title":"arXiv:2407.14358","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2508.20665","last_updated":"2025-08-28T11:15:44Z","snapshot_observed_at":"2026-08-08T21:30:23.489039Z","submitted_at":"2025-08-28T11:15:44Z","title":"Amadeus: Autoregressive Model with Bidirectional Attribute Modelling for Symbolic Music","version":1},"reference_index":2024,"source":"pdf_text","source_observed_at":"2026-08-05T14:59:36.287207Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2508.20665"},"observation_digest":"sha256:f1b55bab8ad4554293acd396ca01eefcf6218ff8d56f8499473062ff18c0f979","observation_id":"99188372-9fbe-4243-b737-f000dd941a49","resolution":{"observed_at":"2026-08-05T14:59:36.287207Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-03T07:06:33.188884Z","title":"Parker, CJ Carr, Zack Zukowski, Josiah Taylor, and Jordi Pons","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2601.21402","last_updated":"2026-07-02T10:34:29Z","snapshot_observed_at":"2026-08-06T16:31:01.007730Z","submitted_at":"2026-01-29T08:40:37Z","title":"SemanticAudio: Audio Generation and Editing in Semantic Space","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T07:06:33.188884Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2601.21402"},"observation_digest":"sha256:e80b189ee161e7a7117cb96824602760dde9c710f2183a20e0bf8f306e274b95","observation_id":"fae88882-d569-439e-af16-9babead6fe10","resolution":{"observed_at":"2026-08-03T07:06:33.188884Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-02T20:07:59.148050Z","title":"Stable audio open,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2602.23958","last_updated":"2026-06-06T08:55:46Z","snapshot_observed_at":"2026-08-07T11:57:01.373368Z","submitted_at":"2026-02-27T12:01:16Z","title":"An Empirical Analysis of Task-Induced Encoder Bias in Fr\\'echet Audio Distance","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-02T20:07:59.148050Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2602.23958"},"observation_digest":"sha256:dac532545a8967539822d2a5c8007e71674f6d6236394c6f81b1293fa522a87c","observation_id":"050c953a-86b5-40c9-bc76-8d369559495f","resolution":{"observed_at":"2026-08-02T20:07:59.148050Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2604.01929","last_updated":"2026-04-29T10:54:09Z","snapshot_observed_at":"2026-07-06T22:51:40.181565Z","submitted_at":"2026-04-02T11:49:00Z","title":"Woosh: A Sound Effects Foundation Model","version":3},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-05-13T20:51:08.144573Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2604.01929"},"observation_digest":"sha256:fd450d489d093ba1b06c24783ed5c69fdfc762b1c0a7f8636ed44bb5572a0628","observation_id":"4aee1cee-311d-4589-b0b4-fa990aacf9de","resolution":{"observed_at":"2026-05-13T20:53:15.802369Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2604.10708","last_updated":"2026-04-26T21:06:11Z","snapshot_observed_at":"2026-08-02T07:50:40.921545Z","submitted_at":"2026-04-12T16:08:20Z","title":"Audio-Omni: Extending Multi-modal Understanding to Versatile Audio Generation and Editing","version":2},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-05-10T15:29:32.711587Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2604.10708"},"observation_digest":"sha256:f3c9074a66f13fc802f9ac4b3983b4b9c08f8ec2cd094d2347b56f23103f7a03","observation_id":"c66936eb-af02-42d6-b603-93e366eef505","resolution":{"observed_at":"2026-05-11T10:26:01.877695Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2604.16254","last_updated":"2026-04-20T15:13:29Z","snapshot_observed_at":"2026-08-08T21:51:03.168031Z","submitted_at":"2026-04-17T17:14:07Z","title":"ArtifactNet: Detecting AI-Generated Music via Forensic Residual Physics","version":2},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-05-10T07:22:07.949007Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2604.16254"},"observation_digest":"sha256:9ad4de9b374ed857def36e795a5c93ee224fcab930b34daed5a67d8dd3a6fb83","observation_id":"fd081297-158a-4360-9dee-5b486b974c09","resolution":{"observed_at":"2026-05-10T07:26:59.762483Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2605.08794","last_updated":"2026-05-16T05:38:25Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:31:17Z","title":"Deterministic Decomposition of Stochastic Generative Dynamics","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-12T02:28:10.800324Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2605.08794"},"observation_digest":"sha256:696dbbf1b17121cccbb95d2a783647e4256926c23be8b0a01b1b03c5dbc89dd5","observation_id":"601229c0-832d-4fe5-a39b-5b7969c54b30","resolution":{"observed_at":"2026-05-12T07:36:52.094339Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2605.08794","last_updated":"2026-05-16T05:38:25Z","snapshot_observed_at":"2026-07-06T23:20:57.084438Z","submitted_at":"2026-05-09T08:31:17Z","title":"Deterministic Decomposition of Stochastic Generative Dynamics","version":2},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-05-20T23:17:47.644647Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2605.08794"},"observation_digest":"sha256:095cf3ca478de19fcea547d87690d6b0219c8848a16373c9e5a878b52c22696f","observation_id":"de1cb7c9-e83f-4182-a872-71491c706a77","resolution":{"observed_at":"2026-05-20T23:19:13.896508Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2605.13931","last_updated":"2026-05-27T00:11:29Z","snapshot_observed_at":"2026-08-03T23:47:52.521727Z","submitted_at":"2026-05-13T16:04:12Z","title":"FSD50K-Solo: Automated Curation of Single-Source Sound Events","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-05-15T02:49:25.499072Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2605.13931"},"observation_digest":"sha256:4a9a078af25d22fd7d434588dd0b61a70cdb34fba33e13d1ed74a088a600c08b","observation_id":"6a0c4d5e-077a-4e89-a375-11621ce173b6","resolution":{"observed_at":"2026-05-15T02:49:41.372804Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2605.13931","last_updated":"2026-05-27T00:11:29Z","snapshot_observed_at":"2026-08-03T23:47:52.521727Z","submitted_at":"2026-05-13T16:04:12Z","title":"FSD50K-Solo: Automated Curation of Single-Source Sound Events","version":2},"reference_index":31,"source":"pdf_text","source_observed_at":"2026-06-30T21:18:08.991522Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2605.13931"},"observation_digest":"sha256:2e1ac3f056df41d01693d2dfb82aa5dc33bdefabdd37e6cf7f5ded65f6a1b8d9","observation_id":"b2a1bfa1-83f1-4301-a49f-60fc84b1fc85","resolution":{"observed_at":"2026-07-01T14:25:47.175725Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2605.21433","last_updated":"2026-05-20T17:23:58Z","snapshot_observed_at":"2026-08-02T08:06:48.596429Z","submitted_at":"2026-05-20T17:23:58Z","title":"Instrumental Text-to-Music Generation with Auxiliary Conditioning Branches","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-05-21T02:43:16.101544Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2605.21433"},"observation_digest":"sha256:df06e3f9a666ea05eba12a5efde45e41d03da3549b970a3a2c8221c119938450","observation_id":"53a8f047-223c-4654-b088-36ff0343791f","resolution":{"observed_at":"2026-05-21T02:43:54.913980Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2606.05852","last_updated":"2026-06-04T08:27:17Z","snapshot_observed_at":"2026-08-09T07:53:36.714139Z","submitted_at":"2026-06-04T08:27:17Z","title":"UniVoice: A Unified Model for Speech and Singing Voice Generation","version":1},"reference_index":27,"source":"pdf_text","source_observed_at":"2026-06-27T23:56:14.198308Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2606.05852"},"observation_digest":"sha256:1f452b88859537f6b7df06e451ed07f12eef37d25d099803d35cda6dcc5be2f8","observation_id":"aa4621d0-3894-4f08-aee7-078f655f7695","resolution":{"observed_at":"2026-07-02T15:17:08.267941Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2606.07271","last_updated":"2026-08-07T10:08:04Z","snapshot_observed_at":"2026-08-10T04:09:38.485216Z","submitted_at":"2026-06-05T13:46:37Z","title":"Where Rectified Flows Leak: Characterising Membership Signals Along the Interpolation Path","version":1},"reference_index":22,"source":"arxiv_source","source_observed_at":"2026-06-27T22:45:28.530332Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2606.07271"},"observation_digest":"sha256:e096bf81d70f3aae3b4d45aa17958d4b85019d2b32816dda8975bc99ddfa6c9a","observation_id":"aec86a2d-ba1d-4808-9fe6-ef6e96ee2411","resolution":{"observed_at":"2026-07-02T16:27:08.945492Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2606.10046","last_updated":"2026-06-10T16:28:45Z","snapshot_observed_at":"2026-08-05T07:13:46.298081Z","submitted_at":"2026-06-08T18:18:28Z","title":"Inside the Latent Flow: Causal Deciphering of Attention Dynamics in Audio Separation Foundation Models","version":2},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-06-27T14:58:27.176375Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2606.10046"},"observation_digest":"sha256:32981fb526a80cae2100021013ebde8eed5d95cbf0e8092c150b4737617d1bbb","observation_id":"272e8f04-9d4f-45f9-92b8-6765519d2e9f","resolution":{"observed_at":"2026-07-03T03:37:36.044182Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2606.12555","last_updated":"2026-07-02T19:10:03Z","snapshot_observed_at":"2026-07-12T14:16:32.755376Z","submitted_at":"2026-06-10T18:06:27Z","title":"AudioX-Turbo: A Unified Framework for Efficient Anything-to-Audio Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-06-27T08:04:48.283908Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2606.12555"},"observation_digest":"sha256:10af94b0c698e5cbad702e98327c0061f717bf190a6df5e701ae81f8a28f7243","observation_id":"e23a889e-4db3-4a78-a499-c3912c65d6b2","resolution":{"observed_at":"2026-07-03T13:28:18.793736Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2606.18072","last_updated":"2026-06-16T15:40:37Z","snapshot_observed_at":"2026-08-07T02:45:15.727363Z","submitted_at":"2026-06-16T15:40:37Z","title":"One-Step Token-to-Waveform Generation with MeanFlow in Latent Space","version":1},"reference_index":25,"source":"pdf_text","source_observed_at":"2026-06-26T22:45:53.073871Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2606.18072"},"observation_digest":"sha256:8ecd2e7b51624bfc13bb071484b114dc4a6ffa46fd8d2dd210a4b8efb1cd2c0c","observation_id":"3a71ef67-510b-404e-a5b6-f4089a034887","resolution":{"observed_at":"2026-07-03T23:19:03.041098Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2606.24307","last_updated":"2026-06-23T08:37:15Z","snapshot_observed_at":"2026-08-09T15:35:25.968156Z","submitted_at":"2026-06-23T08:37:15Z","title":"Real-Time Interactive Music Generation via Data-Free Streaming Consistency Distillation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-06-25T22:42:57.448084Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2606.24307"},"observation_digest":"sha256:213e6f689c88f2ca4af821944657d4d8133c127eaa434fa59cde5cdb355c627a","observation_id":"3567fe17-23cc-4359-8aec-5ae73ffa3d97","resolution":{"observed_at":"2026-07-04T18:40:02.624961Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2606.29148","last_updated":"2026-06-28T02:05:11Z","snapshot_observed_at":"2026-07-07T00:03:07.870153Z","submitted_at":"2026-06-28T02:05:11Z","title":"GPC: Large-Scale Generative Pretraining for Transferable Motor Control","version":1},"reference_index":125,"source":"arxiv_source","source_observed_at":"2026-06-30T08:04:26.007026Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2606.29148"},"observation_digest":"sha256:a5dd1f9a4faa2a9004f87a99c5df38874f5ffe9ae3b4b8335ef92dbcc7cff2a8","observation_id":"7dc14305-62e5-491f-8f1f-99a6f2983199","resolution":{"observed_at":"2026-06-30T08:14:25.937356Z","resolver_source":"arxiv_id","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2607.00641","last_updated":"2026-07-01T08:55:50Z","snapshot_observed_at":"2026-08-03T10:58:40.615764Z","submitted_at":"2026-07-01T08:55:50Z","title":"What's a Credit Worth? A Market Framework for Attribution-Aware Compensation in Generative Music","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-07-02T06:28:24.276953Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2607.00641"},"observation_digest":"sha256:9f2951069cbadd2b5065d14d1e4d5301345e3dac0da00b9ba0392b678a32b635","observation_id":"6fc2bb4e-ed1e-4c70-8ddf-bd37628f01f1","resolution":{"observed_at":"2026-07-02T06:36:43.326948Z","resolver_source":"arxiv_id","status":"verified_exact"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-11T19:59:23.723463Z","title":"Fast timing-conditioned latent audio diffusion","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.04337","last_updated":"2026-07-05T14:35:25Z","snapshot_observed_at":"2026-08-08T12:10:13.889511Z","submitted_at":"2026-07-05T14:35:25Z","title":"Doppelganger: Sound Effects and Their Synthetic Twins","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-07-11T19:59:23.723463Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2607.04337"},"observation_digest":"sha256:67d8f9b48dc35c76bd67e43ec3ae61f98be79b66dcda4226ceba0b04a3372133","observation_id":"aae962a3-ffe9-499a-bb98-c074deed505e","resolution":{"observed_at":"2026-07-11T19:59:23.723463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":"2407.14358","doi":null,"metadata_source":"pith","pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-08T00:04:22.330619Z","title":"D., Carr, C","venue":"cs.SD","work_id":"f51f1d58-4625-4dca-a20f-73a7705ac847","year":2024},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-08-09T15:40:13.197295Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":1},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-07T23:59:38.702609Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:f5d0f86591c390cd6cc63b3f09bab530251d5a6cb8ceb8cf1a7e26ed0213d127","observation_id":"450aa117-cbde-48eb-b56d-6a5af68485ef","resolution":{"observed_at":"2026-07-08T00:04:22.331853Z","resolver_source":"local_arxiv","status":"metadata_mismatch"},"standing_notice":{"events":[],"observation":"No event found in the named queried sources as of 2026-08-09T06:31:02.800959+00:00.","reason":null,"source_receipts":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"state":"measured"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-11T07:46:49.059192Z","title":"arXiv preprint arXiv:2407.14358 , year=","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.05196","last_updated":"2026-07-07T15:36:48Z","snapshot_observed_at":"2026-08-09T15:40:13.197295Z","submitted_at":"2026-07-06T15:11:57Z","title":"Unified Audio Intelligence Without Regressing on Text Intelligence","version":2},"reference_index":69,"source":"arxiv_source","source_observed_at":"2026-07-11T07:46:49.059192Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2607.05196"},"observation_digest":"sha256:ac119b79ad3a1f4fabdea374b61e479997ee2e8ebdb0ebb96b2b994a83fb9a14","observation_id":"87d90333-3efc-45f8-9fbd-7f2b2bb7a00f","resolution":{"observed_at":"2026-07-11T07:46:49.059192Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-07-14T03:47:22.936776Z","title":"Parker, CJ Carr, Zack Zukowski, Josiah Taylor, and Jordi Pons","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-07T07:32:51.039386Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-07-14T03:47:22.936776Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:0e7fc2b8bba4d2712f2a86d9a19108b5775748e160548fa1d06c766ecaea7f0e","observation_id":"2319f5d3-c87f-4f00-b9d4-18739b1bbf65","resolution":{"observed_at":"2026-07-14T03:47:22.936776Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-02T06:52:26.744184Z","title":"Parker, CJ Carr, Zack Zukowski, Josiah Taylor, and Jordi Pons","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.11699","last_updated":"2026-07-27T11:24:39Z","snapshot_observed_at":"2026-08-07T07:32:51.039386Z","submitted_at":"2026-07-13T15:31:45Z","title":"Qwen-Music Technical Report","version":2},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-02T06:52:26.744184Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2607.11699"},"observation_digest":"sha256:c9adf5cd07e6c3b190ea9ba1ce75f8261ba282265962d9ea503163ca67f6c22b","observation_id":"3b51116b-5e17-4cf2-80b0-95f815b455b6","resolution":{"observed_at":"2026-08-02T06:52:26.744184Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-02T06:45:37.651411Z","title":"Parker, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.12121","last_updated":"2026-07-15T22:00:17Z","snapshot_observed_at":"2026-08-02T06:45:34.904229Z","submitted_at":"2026-07-13T20:00:39Z","title":"FlashDiff: Efficient Regional Execution and Scheduling for Diffusion Model Serving","version":2},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-02T06:45:37.651411Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2607.12121"},"observation_digest":"sha256:13b9c12b114223fbbafdcfc7dcd90a5fd4a3f4e0dcadd15aea5882fac140286d","observation_id":"0c2d0736-638d-47c8-8898-c74e50b18623","resolution":{"observed_at":"2026-08-02T06:45:37.651411Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-05T14:08:33.333200Z","title":"Stable audio open,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2608.03721","last_updated":"2026-08-04T14:19:59Z","snapshot_observed_at":"2026-08-09T22:30:54.013533Z","submitted_at":"2026-08-04T14:19:59Z","title":"On the Geometry of Music Bandwidth Extension in Latent Spaces of Audio Codecs","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-05T14:08:33.333200Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2608.03721"},"observation_digest":"sha256:df0f1f5f061b983481162d5239ac4cb42376e31bdba98e260b1198c43b67086c","observation_id":"b48e0512-7fdd-4cd1-8fb9-16935a055e1c","resolution":{"observed_at":"2026-08-05T14:08:33.333200Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2407.14358","snapshot_observed_at":"2026-08-07T23:24:48.989694Z","title":"Parker, C","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2608.05798","last_updated":"2026-08-06T09:34:00Z","snapshot_observed_at":"2026-08-09T23:11:34.471548Z","submitted_at":"2026-08-06T09:34:00Z","title":"KVAE: Family of Tokenizers for Multimodal Generative Models","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-07T23:24:48.989694Z"},"links":{"cited_paper":"/paper/2407.14358","citing_paper":"/paper/2608.05798"},"observation_digest":"sha256:a5cbf435307d30c615b2b0c905754496fa2d8219da791fb652bfe2c1dbe0436f","observation_id":"4502afe0-0465-4f0f-9d01-890af4e52d42","resolution":{"observed_at":"2026-08-07T23:24:48.989694Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"links":{"evidence":"/evidence","html":"/paper/2407.14358/citation-record","integrity":"/paper/2407.14358/integrity","json":"/paper/2407.14358/citation-record.json","paper":"/paper/2407.14358"},"outbound":[],"paper":{"arxiv_id":"2407.14358","last_updated":"2024-07-31T16:22:42Z","latest_version":2,"primary_category":"cs.SD","snapshot_observed_at":"2026-08-06T16:30:00.821754Z","submitted_at":"2024-07-19T14:40:23Z","title":"Stable Audio Open"},"reference_resolution":{"displayed":0,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":0,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":0},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-09T06:31:02.800959+00:00","source":"crossref"},{"observed_at":"2026-08-09T06:30:57.326959+00:00","source":"retraction_watch"}],"thesis":"As of 10 August 2026, this Paper Citation Record lists 0 of 0 outbound references and 39 inbound Pith citation observations for arXiv:2407.14358."}