{"as_of":"2026-08-14T23:30:00Z","caps":{"database_statements":6,"inbound":100,"outbound":100},"context_digest":"sha256:ab3b20cd58643e128495b851064171b0dac4226e338ce23002d30b2263a2d2bd","coverage":[{"denominator":24,"lane":"reference_resolution","note":"Typed states for the displayed outbound observations.","records_observed":24,"source":"paper_references, paper_reference_links","source_observed_at":"2026-08-03T12:47:00.255183Z","state":"measured"},{"denominator":24,"lane":"standing_notices","note":"One-hop event checks from named stored sources.","records_observed":24,"source":"scholarly_work_events, retraction_status_cache","source_observed_at":"2026-08-14T06:32:32.682623+00:00","state":"measured"},{"denominator":0,"lane":"inbound_itemization","note":"Pith citing papers itemized under the disclosed page cap.","records_observed":0,"source":"paper_references, paper_reference_links","source_observed_at":null,"state":"measured"},{"denominator":1,"lane":"external_citation_measurements","note":"A source-named dated measurement, never combined with another source.","records_observed":0,"source":"cited_works","source_observed_at":null,"state":"measured"}],"external_citation_measurements":[],"inbound":[],"links":{"evidence":"/evidence","html":"/paper/2607.29148/citation-record","integrity":"/paper/2607.29148/integrity","json":"/paper/2607.29148/citation-record.json","paper":"/paper/2607.29148"},"outbound":[{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:58.420921Z","title":"Foleygan: Visu- ally guided generative adversarial network-based syn- chronous sound generation in silent videos,","venue":null,"work_id":null,"year":2022},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":1,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:58.420921Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:b11741a6391cb43c5f65eb2ec248afbb6a6d6b09c39fc44461c658f087e4c5af","observation_id":"b7faae89-7517-47d2-8fbd-566671c26b64","resolution":{"observed_at":"2026-08-03T12:46:58.420921Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:58.471416Z","title":"The x-lance system for dcase2023 challenge task 7: Foley sound synthesis track b,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":2,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:58.471416Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:0ed2b89a565ff87c4af7543cec9df326fb58ddd43ee26865c49935bd78517bc5","observation_id":"e2e21079-58d3-4071-840c-8f226764a765","resolution":{"observed_at":"2026-08-03T12:46:58.471416Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:58.566213Z","title":"Mtdiffusion: Multi- task diffusion model with dual-unet for foley sound generation,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":3,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:58.566213Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:819aaabcb6a35fc2804abb824f85942056a3dbecaf49f3c21cd1b4908b579436","observation_id":"44e02b7d-27d6-494a-adef-748b392c51f2","resolution":{"observed_at":"2026-08-03T12:46:58.566213Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:58.673463Z","title":"Rhythmic foley: A framework for seamless audio-visual alignment in video-to-audio synthesis,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":4,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:58.673463Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:fb3511ec09c4f235f65ae9a8852d8690a18a1a7d9fccc13f89b36df15001f66a","observation_id":"a8cc5034-618d-477f-bfa9-f77711cedb6a","resolution":{"observed_at":"2026-08-03T12:46:58.673463Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:58.781442Z","title":"T-foley: A controllable waveform-domain diffusion model for temporal-event- guided foley sound synthesis,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":5,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:58.781442Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:66cc10370473c66b745e178ae60490dec069993d00999cadc2091a26b9f7690f","observation_id":"8b3ef8bd-5fbc-4dbc-8fc3-b9955bbdad09","resolution":{"observed_at":"2026-08-03T12:46:58.781442Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.10359","last_updated":"2023-09-18T10:35:17Z","snapshot_observed_at":"2026-08-13T11:14:47.359404Z","submitted_at":"2023-06-17T14:16:24Z","title":"Text-Driven Foley Sound Generation With Latent Diffusion Model","version":5},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.10359","snapshot_observed_at":"2026-08-03T12:46:58.862868Z","title":"Text-driven foley sound genera- tion with latent diffusion model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":6,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:58.862868Z"},"links":{"cited_paper":"/paper/2306.10359","citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:ddd212edbf6d291268e4bc148e54040c4d909c15cad37b757b086a6e1907a980","observation_id":"66d2d469-9ce7-4885-ada3-0d6d8c8eec1f","resolution":{"observed_at":"2026-08-03T12:46:58.862868Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2301.12503","last_updated":"2023-09-09T15:27:58Z","snapshot_observed_at":"2026-08-13T12:55:40.566213Z","submitted_at":"2023-01-29T17:48:17Z","title":"AudioLDM: Text-to-Audio Generation with Latent Diffusion Models","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2301.12503","snapshot_observed_at":"2026-08-03T12:46:58.947785Z","title":"Audioldm: Text-to-audio genera- tion with latent diffusion models,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":7,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:58.947785Z"},"links":{"cited_paper":"/paper/2301.12503","citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:54e776e802663b2358381aff1062024f4cc75aef1cc9c21cb0c445ff4e1e9864","observation_id":"8e6509e6-dac5-48c8-9391-0c7876ebc211","resolution":{"observed_at":"2026-08-03T12:46:58.947785Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:59.077301Z","title":"Audioldm 2: Learning holistic audio generation with self-supervised pretraining,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":8,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.077301Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:0bbb172daa310d3bd0f173505f3fa1afce208b9a59f6cb74e17c4657fd53ae7f","observation_id":"13aa4e11-f584-4fb5-a94b-3f1d056adb00","resolution":{"observed_at":"2026-08-03T12:46:59.077301Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:59.169116Z","title":"Generative speech foundation model pre- training for high-quality speech extraction and restora- tion,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":9,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.169116Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:4fe2989ea0e9c0aa159032ff8d69416fb7ecddbe360e97ad91e68318709a341a","observation_id":"5fcd8b7b-cf3a-46e5-8093-3caeff0681c3","resolution":{"observed_at":"2026-08-03T12:46:59.169116Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:59.293363Z","title":"Dual-path rnn: Ef- ficient long sequence modeling for time-domain single- channel speech separation,","venue":null,"work_id":null,"year":2020},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":10,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.293363Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:e0447fc2e888960ddc689f04cb800234d9bdc6d4e3370fd97f64db10970f3831","observation_id":"fc5404f4-d96a-4b8e-8479-6aa933bd6c08","resolution":{"observed_at":"2026-08-03T12:46:59.293363Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:59.406840Z","title":"A study on speech enhancement based on diffusion probabilistic model,","venue":null,"work_id":null,"year":2021},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":11,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.406840Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:0ee5b334e16d44c0dcb7e4d68c6c899c9b09fb90f117708ccad6ee6d604b3628","observation_id":"6346c9a8-642c-4cbc-870a-67acc081768c","resolution":{"observed_at":"2026-08-03T12:46:59.406840Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:59.456317Z","title":"Unsupervised single-channel audio sep- aration with diffusion source priors,","venue":null,"work_id":null,"year":2026},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":12,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.456317Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:4eceb8fb9aaac884a5ea8592ece631e2af66312e2f0f98fe2e61119a2f068758","observation_id":"f42dd0bd-c244-476c-b2fe-43aa44a00dcf","resolution":{"observed_at":"2026-08-03T12:46:59.456317Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:59.525316Z","title":"Mambafoley: Foley sound generation using selective state-space models,","venue":null,"work_id":null,"year":2025},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":13,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.525316Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:018397ce9508838b19879eb7b67e4a217bbb0e4fb52393776172773f9bc0d23a","observation_id":"367a5819-130d-4faa-9a77-92d11bd494ac","resolution":{"observed_at":"2026-08-03T12:46:59.525316Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:59.615845Z","title":"Full-band general audio synthesis with score- based diffusion,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":14,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.615845Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:9a8d0035719b192bd10a05cd5260c9f6ca6d56b7882c2797f58266424a28b121","observation_id":"f6f8ba3a-c65d-476a-b286-830334482bc2","resolution":{"observed_at":"2026-08-03T12:46:59.615845Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:59.663901Z","title":"Diffwave: A versatile diffusion model for audio synthesis,","venue":null,"work_id":null,"year":null},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":15,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.663901Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:1a2268bbbb29528481d84bbdbb60efa7e8ef2dc867b93256a83ec2d8178197dc","observation_id":"cacf177a-1e36-4216-8978-fd6a2a216346","resolution":{"observed_at":"2026-08-03T12:46:59.663901Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1609.03499","last_updated":"2016-09-19T18:04:35Z","snapshot_observed_at":"2026-08-13T01:24:25.628327Z","submitted_at":"2016-09-12T17:29:40Z","title":"WaveNet: A Generative Model for Raw Audio","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1609.03499","snapshot_observed_at":"2026-08-03T12:46:59.714092Z","title":"Wavenet: A generative model for raw audio,","venue":null,"work_id":null,"year":2016},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":16,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.714092Z"},"links":{"cited_paper":"/paper/1609.03499","citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:b0f8a6df967677861ecd3b48d971aa269d342367f30326e942a6157cdb506e9a","observation_id":"14582748-2ac1-4ebd-9b42-f39e00e5c434","resolution":{"observed_at":"2026-08-03T12:46:59.714092Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:59.773065Z","title":"Fregrad: Lightweight and fast frequency-aware diffusion vocoder,","venue":null,"work_id":null,"year":2024},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":17,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.773065Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:0c8f4dad590de009c15ca608cb060154511494f68cb1a06909dd6d0bc6ccb15f","observation_id":"56df86ed-dd3c-467a-a138-6a7803d005f7","resolution":{"observed_at":"2026-08-03T12:46:59.773065Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2306.00721","last_updated":"2023-10-12T10:32:01Z","snapshot_observed_at":"2026-08-13T11:27:16.731587Z","submitted_at":"2023-06-01T14:22:55Z","title":"UnDiff: Unsupervised Voice Restoration with Unconditional Diffusion Model","version":2},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2306.00721","snapshot_observed_at":"2026-08-03T12:46:59.820387Z","title":"Undiff: Unsupervised voice restoration with unconditional diffusion model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":18,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.820387Z"},"links":{"cited_paper":"/paper/2306.00721","citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:b20678a121821f02235f530c8d5a2e42bb6cf5a820154fcfbd07f9a9dbc19a52","observation_id":"2eea032b-d09e-4b00-a289-3660bdc6e82c","resolution":{"observed_at":"2026-08-03T12:46:59.820387Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:46:59.906532Z","title":"Solving audio inverse problems with a diffusion model,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":19,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.906532Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:93f6b57ab73a390979dec7d9c9fb742dd26fb6f8f1165fb2958133dd647958df","observation_id":"690cc6c0-2e86-4641-8332-34544f01c746","resolution":{"observed_at":"2026-08-03T12:46:59.906532Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"2304.12521","last_updated":"2023-09-28T18:38:21Z","snapshot_observed_at":"2026-08-13T11:55:48.711522Z","submitted_at":"2023-04-25T02:28:32Z","title":"Foley Sound Synthesis at the DCASE 2023 Challenge","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"2304.12521","snapshot_observed_at":"2026-08-03T12:46:59.967862Z","title":"Foley sound synthesis at the dcase 2023 challenge,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":20,"source":"pdf_text","source_observed_at":"2026-08-03T12:46:59.967862Z"},"links":{"cited_paper":"/paper/2304.12521","citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:afb4a91a40043d2aa68c6912afec665424476671d45c19ddde46d6a8185c28ee","observation_id":"65e250d6-84ca-4ec1-b5c3-87298b4826ae","resolution":{"observed_at":"2026-08-03T12:46:59.967862Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":null,"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":null,"snapshot_observed_at":"2026-08-03T12:47:00.032718Z","title":"Scalable diffusion models with transformers,","venue":null,"work_id":null,"year":2023},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":21,"source":"pdf_text","source_observed_at":"2026-08-03T12:47:00.032718Z"},"links":{"citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:1b8552132e2514515f9b78c0838545c08f12b6ba4b7008a2acaf5eca131e4cf3","observation_id":"c9b1bd9d-29cc-4567-9f64-681b9d0ba6b2","resolution":{"observed_at":"2026-08-03T12:47:00.032718Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1807.09902","last_updated":"2018-10-07T02:25:28Z","snapshot_observed_at":"2026-08-14T18:47:40.122043Z","submitted_at":"2018-07-26T00:30:54Z","title":"General-purpose Tagging of Freesound Audio with AudioSet Labels: Task Description, Dataset, and Baseline","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1807.09902","snapshot_observed_at":"2026-08-03T12:47:00.111103Z","title":"General-purpose tagging of freesound audio with audioset labels: Task description, dataset, and baseline,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":22,"source":"pdf_text","source_observed_at":"2026-08-03T12:47:00.111103Z"},"links":{"cited_paper":"/paper/1807.09902","citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:40c643d2e3098cfebeecd53f72fada64b4530bace13dc3286eda3054bb08c53c","observation_id":"b3d4713e-705c-430f-abac-c7374293af9e","resolution":{"observed_at":"2026-08-03T12:47:00.111103Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1711.05101","last_updated":"2019-01-04T21:01:49Z","snapshot_observed_at":"2026-08-14T20:13:52.872565Z","submitted_at":"2017-11-14T14:24:06Z","title":"Decoupled Weight Decay Regularization","version":3},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1711.05101","snapshot_observed_at":"2026-08-03T12:47:00.165216Z","title":"Decoupled weight decay regularization,","venue":null,"work_id":null,"year":2017},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":23,"source":"pdf_text","source_observed_at":"2026-08-03T12:47:00.165216Z"},"links":{"cited_paper":"/paper/1711.05101","citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:e00a31fd6b944ff723ea516a1530185d58a802570fdef699fd39c8f0e463280a","observation_id":"cf6d8bac-7564-4a98-8948-0629a54414e6","resolution":{"observed_at":"2026-08-03T12:47:00.165216Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}},{"citation":{"cited_paper":{"arxiv_id":"1812.08466","last_updated":"2019-01-17T16:12:43Z","snapshot_observed_at":"2026-08-14T17:40:40.006528Z","submitted_at":"2018-12-20T10:28:00Z","title":"Fr\\'echet Audio Distance: A Metric for Evaluating Music Enhancement Algorithms","version":4},"cited_work":{"arxiv_id":null,"doi":null,"metadata_source":null,"pith_arxiv_id":"1812.08466","snapshot_observed_at":"2026-08-03T12:47:00.255183Z","title":"Fr\\’echet audio distance: A metric for evalu- ating music enhancement algorithms,","venue":null,"work_id":null,"year":2018},"citing_paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation","version":1},"reference_index":24,"source":"pdf_text","source_observed_at":"2026-08-03T12:47:00.255183Z"},"links":{"cited_paper":"/paper/1812.08466","citing_paper":"/paper/2607.29148"},"observation_digest":"sha256:5e42959fb78f51e875461fffeac1ff26873124114dcb717de464f2711f7638c4","observation_id":"b26af08f-57c4-46ea-8b12-a2f75bbfd77a","resolution":{"observed_at":"2026-08-03T12:47:00.255183Z","resolver_source":null,"status":"unresolved"},"standing_notice":{"events":[],"reason":"canonical_work_link_unavailable","source_receipts":[],"state":"unavailable"}}],"paper":{"arxiv_id":"2607.29148","last_updated":"2026-07-31T08:30:23Z","latest_version":1,"primary_category":"eess.AS","snapshot_observed_at":"2026-08-13T21:00:48.555289Z","submitted_at":"2026-07-31T08:30:23Z","title":"Exploring Efficient Waveform Diffusion Models for Foley Sound Generation"},"reference_resolution":{"displayed":24,"state_counts":{"malformed_identifier":0,"metadata_mismatch":0,"parse_uncertain":0,"unresolved":24,"verified_exact":0,"verified_fuzzy":0},"total_outbound_references":24},"refusal":"A citation records a reference. It does not transfer a finding from one paper to another.","schema":"pith.paper-citation-record.v1","standing_sources":[{"observed_at":"2026-08-14T06:32:32.682623+00:00","source":"crossref"},{"observed_at":"2026-08-14T06:32:18.44784+00:00","source":"retraction_watch"}],"thesis":"As of 14 August 2026, this Paper Citation Record lists 24 of 24 outbound references and 0 inbound Pith citation observations for arXiv:2607.29148."}